{"as_of":"2026-08-15T09:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:124624a799e8bffb21bb994ab5989a14fed92081cefdc6033ac52adab44f64aa","coverage":[{"denominator":45,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":45,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T14:24:11.857220Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T11:48:48.565876Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-30T12:24:39.611081Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.15399","last_updated":"2024-11-23T00:51:09Z","snapshot_observed_at":"2026-08-14T12:58:20.383033Z","submitted_at":"2024-11-23T00:51:09Z","title":"Less is More: Optimizing Function Calling for LLM Execution on Edge Devices","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15399","snapshot_observed_at":"2026-08-12T11:48:48.565876Z","title":"Less is more: Optimizing function calling for llm execution on edge devices,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.17867","last_updated":"2024-11-26T20:34:17Z","snapshot_observed_at":"2026-08-14T15:48:51.731003Z","submitted_at":"2024-11-26T20:34:17Z","title":"RankMap: Priority-Aware Multi-DNN Manager for Heterogeneous Embedded Devices","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T11:48:48.565876Z"},"links":{"cited_paper":"/paper/2411.15399","citing_paper":"/paper/2411.17867"},"observation_digest":"sha256:0fe7907ccb96cd3dcb726b6e39de0fa5af59544874b5a19950a162f4cb18bfac","observation_id":"79448b88-fae3-47ea-b91f-bab6a7a264d8","resolution":{"observed_at":"2026-08-12T11:48:48.565876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15399","last_updated":"2024-11-23T00:51:09Z","snapshot_observed_at":"2026-08-14T12:58:20.383033Z","submitted_at":"2024-11-23T00:51:09Z","title":"Less is More: Optimizing Function Calling for LLM Execution on Edge Devices","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15399","snapshot_observed_at":"2026-08-10T13:41:49.029152Z","title":"Less is more: Optimizing function calling for llm execution on edge devices,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.16254","last_updated":"2025-01-27T17:54:31Z","snapshot_observed_at":"2026-08-11T12:59:49.485755Z","submitted_at":"2025-01-27T17:54:31Z","title":"Multi-Agent Geospatial Copilots for Remote Sensing Workflows","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T13:41:49.029152Z"},"links":{"cited_paper":"/paper/2411.15399","citing_paper":"/paper/2501.16254"},"observation_digest":"sha256:c99b1b9e12d0674557e0efe7f7a83e599ae61529ffeaf70d311ba3c93272597b","observation_id":"2ae8b306-a0ac-4463-9220-5c63be9f07cb","resolution":{"observed_at":"2026-08-10T13:41:49.029152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15399","last_updated":"2024-11-23T00:51:09Z","snapshot_observed_at":"2026-08-14T12:58:20.383033Z","submitted_at":"2024-11-23T00:51:09Z","title":"Less is More: Optimizing Function Calling for LLM Execution on Edge Devices","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15399","snapshot_observed_at":"2026-08-07T05:04:51.040375Z","title":"Less is More: Optimizing Function Calling for LLM Execution on Edge Devices,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08757","last_updated":"2025-06-10T12:55:07Z","snapshot_observed_at":"2026-08-14T10:26:07.711121Z","submitted_at":"2025-06-10T12:55:07Z","title":"Enhancing Accuracy and Maintainability in Nuclear Plant Data Retrieval: A Function-Calling LLM Approach Over NL-to-SQL","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:51.040375Z"},"links":{"cited_paper":"/paper/2411.15399","citing_paper":"/paper/2506.08757"},"observation_digest":"sha256:a85c4a8a4d0cd083ffce3cca8ffbb9450034ad00d176922a8f57948622470c2c","observation_id":"0b451210-e2ff-44fe-832e-6a73720ed1c1","resolution":{"observed_at":"2026-08-07T05:04:51.040375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15399","last_updated":"2024-11-23T00:51:09Z","snapshot_observed_at":"2026-08-14T12:58:20.383033Z","submitted_at":"2024-11-23T00:51:09Z","title":"Less is More: Optimizing Function Calling for LLM Execution on Edge Devices","version":1},"cited_work":{"arxiv_id":"2411.15399","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.15399","snapshot_observed_at":"2026-06-30T12:24:39.611081Z","title":"Less is More: Optimizing Function Calling for LLM Execution on Edge Devices","venue":null,"work_id":"b34a3f7e-a57a-4e7d-abf9-628ee47f2440","year":2025},"citing_paper":{"arxiv_id":"2605.24660","last_updated":"2026-06-07T02:58:55Z","snapshot_observed_at":"2026-08-12T22:54:59.017055Z","submitted_at":"2026-05-23T17:02:56Z","title":"How Many Tools Should an LLM Agent See? A Chance-Corrected Answer","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-30T12:22:59.494989Z"},"links":{"cited_paper":"/paper/2411.15399","citing_paper":"/paper/2605.24660"},"observation_digest":"sha256:882b170dded89632193162147001f5c4354773e66c4672ad709013762712f9c9","observation_id":"f0313424-9246-4c50-811c-662018c6f64f","resolution":{"observed_at":"2026-06-30T12:24:39.613436Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2411.15399/citation-record","integrity":"/paper/2411.15399/integrity","json":"/paper/2411.15399/citation-record.json","paper":"/paper/2411.15399"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2305.15334","last_updated":"2023-05-24T16:48:11Z","snapshot_observed_at":"2026-08-14T14:07:14.900729Z","submitted_at":"2023-05-24T16:48:11Z","title":"Gorilla: Large Language Model Connected with Massive APIs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15334","snapshot_observed_at":"2026-08-12T14:24:11.661927Z","title":"Gorilla: Large language model connected with massive apis,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15399","last_updated":"2024-11-23T00:51:09Z","snapshot_observed_at":"2026-08-14T12:58:20.383033Z","submitted_at":"2024-11-23T00:51:09Z","title":"Less is More: Optimizing Function Calling for LLM Execution on Edge Devices","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T14:24:11.661927Z"},"links":{"cited_paper":"/paper/2305.15334","citing_paper":"/paper/2411.15399"},"observation_digest":"sha256:f55f3867cb0c3dbe839164ff3dd96adac6b2a9dcf6d0a3e5243fcad164554531","observation_id":"40fee13b-c05e-49de-a1d4-2424fd0e2916","resolution":{"observed_at":"2026-08-12T14:24:11.661927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:24:11.666741Z","title":"Pythia: An edge first agent for state prediction in high-dimensional environments,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.15399","last_updated":"2024-11-23T00:51:09Z","snapshot_observed_at":"2026-08-14T12:58:20.383033Z","submitted_at":"2024-11-23T00:51:09Z","title":"Less is More: Optimizing Function Calling for LLM Execution on Edge Devices","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T14:24:11.666741Z"},"links":{"citing_paper":"/paper/2411.15399"},"observation_digest":"sha256:e969253922daf538162e88914e33334512c897ee5d44ad1aeb660317727be05a","observation_id":"29ef84d8-4680-4e51-a943-f7366b73e152","resolution":{"observed_at":"2026-08-12T14:24:11.666741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16363","last_updated":"2024-05-01T20:42:28Z","snapshot_observed_at":"2026-08-13T04:10:18.599255Z","submitted_at":"2024-02-26T07:33:05Z","title":"LLM Inference Unveiled: Survey and Roofline Model Insights","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16363","snapshot_observed_at":"2026-08-12T14:24:11.671166Z","title":"Llm inference unveiled: Survey and roofline model insights,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.15399","last_updated":"2024-11-23T00:51:09Z","snapshot_observed_at":"2026-08-14T12:58:20.383033Z","submitted_at":"2024-11-23T00:51:09Z","title":"Less is More: Optimizing Function Calling for LLM Execution on Edge Devices","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T14:24:11.671166Z"},"links":{"cited_paper":"/paper/2402.16363","citing_paper":"/paper/2411.15399"},"observation_digest":"sha256:b7da661da304fe7e25b48a2d01b97607c5556778b7df02dfde9cc72838fcad6b","observation_id":"6b709798-8c52-4a76-9bfe-d73e110daa18","resolution":{"observed_at":"2026-08-12T14:24:11.671166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:24:12.469726Z","title":"Function calling documentation,","venue":null,"work_id":"69498b2f-7c9b-498b-9a5e-54a5183b0cc9","year":null},"citing_paper":{"arxiv_id":"2411.15399","last_updated":"2024-11-23T00:51:09Z","snapshot_observed_at":"2026-08-14T12:58:20.383033Z","submitted_at":"2024-11-23T00:51:09Z","title":"Less is More: Optimizing Function Calling for LLM Execution on Edge Devices","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T14:24:11.676122Z"},"links":{"citing_paper":"/paper/2411.15399"},"observation_digest":"sha256:7da46d422a1fcd332d2e56e24abb1595aae529233ab373e5cb9b293914c17b25","observation_id":"ca27a5e6-e48c-4e90-a647-88b94dc0ad12","resolution":{"observed_at":"2026-08-12T14:24:12.474347Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:24:12.455853Z","title":"ReAct: Synergizing reasoning and acting in language models,","venue":null,"work_id":"d4f03332-a02e-4166-987a-5ceef4f1ff78","year":2023},"citing_paper":{"arxiv_id":"2411.15399","last_updated":"2024-11-23T00:51:09Z","snapshot_observed_at":"2026-08-14T12:58:20.383033Z","submitted_at":"2024-11-23T00:51:09Z","title":"Less is More: Optimizing Function Calling for LLM Execution on Edge Devices","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T14:24:11.680529Z"},"links":{"citing_paper":"/paper/2411.15399"},"observation_digest":"sha256:a25950a19c8d83f83e7d8610feb798293470b2773c524cdf93897346c1e4ff61","observation_id":"351492b3-941d-4ad5-b977-a91bb68bf036","resolution":{"observed_at":"2026-08-12T14:24:12.460162Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:24:12.440840Z","title":"Single-path nas: Designing hardware-efficient convnets in less than 4 hours,","venue":null,"work_id":"f1a3c5cc-2f7a-49f6-8d40-e7514f572b89","year":2019},"citing_paper":{"arxiv_id":"2411.15399","last_updated":"2024-11-23T00:51:09Z","snapshot_observed_at":"2026-08-14T12:58:20.383033Z","submitted_at":"2024-11-23T00:51:09Z","title":"Less is More: Optimizing Function Calling for LLM Execution on Edge Devices","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T14:24:11.685102Z"},"links":{"citing_paper":"/paper/2411.15399"},"observation_digest":"sha256:fa3b8e8682f20877cdc0225d6a00285d52bd6a1a6a4a09b3c123c69e642e8a38","observation_id":"90e4fa1a-187a-4297-bc22-cdeaad9c0da6","resolution":{"observed_at":"2026-08-12T14:24:12.445881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14219","last_updated":"2024-08-30T21:17:17Z","snapshot_observed_at":"2026-08-10T14:07:02.234322Z","submitted_at":"2024-04-22T14:32:33Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14219","snapshot_observed_at":"2026-08-12T14:24:11.689597Z","title":"Phi-3 technical report: A highly capable language model locally on your phone,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.15399","last_updated":"2024-11-23T00:51:09Z","snapshot_observed_at":"2026-08-14T12:58:20.383033Z","submitted_at":"2024-11-23T00:51:09Z","title":"Less is More: Optimizing Function Calling for LLM Execution on Edge Devices","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T14:24:11.689597Z"},"links":{"cited_paper":"/paper/2404.14219","citing_paper":"/paper/2411.15399"},"observation_digest":"sha256:cb38c99a1838329b79c697540964132293e9978c6141444541e36f1c363d4d1c","observation_id":"5cbe40ca-9e82-41a2-a7b9-94c487a37cb7","resolution":{"observed_at":"2026-08-12T14:24:11.689597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:24:12.426336Z","title":"Function calling,","venue":null,"work_id":"e4394737-507e-48c5-9c51-7156c2a9582d","year":2024},"citing_paper":{"arxiv_id":"2411.15399","last_updated":"2024-11-23T00:51:09Z","snapshot_observed_at":"2026-08-14T12:58:20.383033Z","submitted_at":"2024-11-23T00:51:09Z","title":"Less is More: Optimizing Function Calling for LLM Execution on Edge Devices","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T14:24:11.694698Z"},"links":{"citing_paper":"/paper/2411.15399"},"observation_digest":"sha256:7495c7f6de59cfeecae739640de4c767dfe1b6b755116fc00e1d1ac84c56f4b0","observation_id":"06dad151-fef4-4232-a709-c9a1df0dcf76","resolution":{"observed_at":"2026-08-12T14:24:12.430760Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:24:12.412296Z","title":"Tool support,","venue":null,"work_id":"b44ceadd-beb8-4250-b662-c6e7e3ef03ae","year":2024},"citing_paper":{"arxiv_id":"2411.15399","last_updated":"2024-11-23T00:51:09Z","snapshot_observed_at":"2026-08-14T12:58:20.383033Z","submitted_at":"2024-11-23T00:51:09Z","title":"Less is More: Optimizing Function Calling for LLM Execution on Edge Devices","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T14:24:11.699073Z"},"links":{"citing_paper":"/paper/2411.15399"},"observation_digest":"sha256:8e47a5bdd94e284e66c945549a3ebf09ba0837972dea82c083a66588cdfe6fe5","observation_id":"02b34c44-e02b-4d3a-8a99-2a6682013577","resolution":{"observed_at":"2026-08-12T14:24:12.416689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.00608","last_updated":"2024-10-25T01:16:55Z","snapshot_observed_at":"2026-08-12T22:53:44.459273Z","submitted_at":"2024-09-01T04:23:48Z","title":"TinyAgent: Function Calling at the Edge","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.00608","snapshot_observed_at":"2026-08-12T14:24:11.703447Z","title":"Tinyagent: Function calling at the edge,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.15399","last_updated":"2024-11-23T00:51:09Z","snapshot_observed_at":"2026-08-14T12:58:20.383033Z","submitted_at":"2024-11-23T00:51:09Z","title":"Less is More: Optimizing Function Calling for LLM Execution on Edge Devices","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T14:24:11.703447Z"},"links":{"cited_paper":"/paper/2409.00608","citing_paper":"/paper/2411.15399"},"observation_digest":"sha256:99153f239676e7804a8567104e545db5224b054867ae779dc8c579f6dd93c94e","observation_id":"141c4cfa-3ec8-436a-b067-a8b031cc59d9","resolution":{"observed_at":"2026-08-12T14:24:11.703447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:24:12.397767Z","title":"Berkeley function calling leaderboard,","venue":null,"work_id":"f1fbae12-9118-456f-986c-48d0234905c9","year":2024},"citing_paper":{"arxiv_id":"2411.15399","last_updated":"2024-11-23T00:51:09Z","snapshot_observed_at":"2026-08-14T12:58:20.383033Z","submitted_at":"2024-11-23T00:51:09Z","title":"Less is More: Optimizing Function Calling for LLM Execution on Edge Devices","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T14:24:11.708128Z"},"links":{"citing_paper":"/paper/2411.15399"},"observation_digest":"sha256:cce12b718ea87e9f3f8c64539e9a12aa5b49080f12e76505ab44ceff113984da","observation_id":"374200f3-9233-4849-bfda-9289d624c26c","resolution":{"observed_at":"2026-08-12T14:24:12.402428Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:24:12.383339Z","title":"Geollm-engine: A realistic environ- ment for building geospatial copilots,","venue":null,"work_id":"c25fa374-246f-400c-a887-4834132d5a43","year":2024},"citing_paper":{"arxiv_id":"2411.15399","last_updated":"2024-11-23T00:51:09Z","snapshot_observed_at":"2026-08-14T12:58:20.383033Z","submitted_at":"2024-11-23T00:51:09Z","title":"Less is More: Optimizing Function Calling for LLM Execution on Edge Devices","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T14:24:11.712782Z"},"links":{"citing_paper":"/paper/2411.15399"},"observation_digest":"sha256:dc623801c1220d5a57421b3445c25e85b188bd1145aa00e19a608d9de29786f5","observation_id":"85b0d801-6598-4483-8804-82ca28db4085","resolution":{"observed_at":"2026-08-12T14:24:12.387892Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:24:12.368810Z","title":"Nvidia jetson agx orin series,","venue":null,"work_id":"b9e3178d-97d1-4895-ae6e-ec07efaefea6","year":2022},"citing_paper":{"arxiv_id":"2411.15399","last_updated":"2024-11-23T00:51:09Z","snapshot_observed_at":"2026-08-14T12:58:20.383033Z","submitted_at":"2024-11-23T00:51:09Z","title":"Less is More: Optimizing Function Calling for LLM Execution on Edge Devices","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T14:24:11.717095Z"},"links":{"citing_paper":"/paper/2411.15399"},"observation_digest":"sha256:476c81a83d4ba235cca14fa041d05b8472679997f4126ff3628bffe2809c2e88","observation_id":"8ef409ff-9e2f-49e3-82b9-cdf209e81911","resolution":{"observed_at":"2026-08-12T14:24:12.373542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:24:11.721402Z","title":"Qlora: Efficient finetuning of quantized llms,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.15399","last_updated":"2024-11-23T00:51:09Z","snapshot_observed_at":"2026-08-14T12:58:20.383033Z","submitted_at":"2024-11-23T00:51:09Z","title":"Less is More: Optimizing Function Calling for LLM Execution on Edge Devices","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T14:24:11.721402Z"},"links":{"citing_paper":"/paper/2411.15399"},"observation_digest":"sha256:79332a16d7ef30e8805b6a105900c83ba9b3734399e05111a23c898405588879","observation_id":"ecbf7e0a-e6bb-4259-ba42-7808e9cb92eb","resolution":{"observed_at":"2026-08-12T14:24:11.721402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:24:11.726037Z","title":"Llm-pruner: On the structural pruning of large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15399","last_updated":"2024-11-23T00:51:09Z","snapshot_observed_at":"2026-08-14T12:58:20.383033Z","submitted_at":"2024-11-23T00:51:09Z","title":"Less is More: Optimizing Function Calling for LLM Execution on Edge Devices","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T14:24:11.726037Z"},"links":{"citing_paper":"/paper/2411.15399"},"observation_digest":"sha256:fbf3d438b3e0a9180387a39fa9b8511a6c874da7a93f3a198250c4bf4075d475","observation_id":"fd5d4bdf-2094-4a16-89a6-60e60b5b6783","resolution":{"observed_at":"2026-08-12T14:24:11.726037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:24:11.730448Z","title":"Efficient memory management for large language model serving with pagedattention,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15399","last_updated":"2024-11-23T00:51:09Z","snapshot_observed_at":"2026-08-14T12:58:20.383033Z","submitted_at":"2024-11-23T00:51:09Z","title":"Less is More: Optimizing Function Calling for LLM Execution on Edge Devices","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T14:24:11.730448Z"},"links":{"citing_paper":"/paper/2411.15399"},"observation_digest":"sha256:ce3ac9229683e8ffffb3741be0c2c5d05f4570787a25fc320d245664c3d13335","observation_id":"0595990b-7f37-4f56-86e1-ea1404a48ca0","resolution":{"observed_at":"2026-08-12T14:24:11.730448Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:24:12.325270Z","title":"MiniLLM: Knowledge distilla- tion of large language models,","venue":null,"work_id":"b34a68dd-956d-426a-91d6-75b4b165b0be","year":2024},"citing_paper":{"arxiv_id":"2411.15399","last_updated":"2024-11-23T00:51:09Z","snapshot_observed_at":"2026-08-14T12:58:20.383033Z","submitted_at":"2024-11-23T00:51:09Z","title":"Less is More: Optimizing Function Calling for LLM Execution on Edge Devices","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T14:24:11.734604Z"},"links":{"citing_paper":"/paper/2411.15399"},"observation_digest":"sha256:56f4c788cd69a16a66273cf76f791c3c59cefd1f2b046b8de62d2c80ef45a2fc","observation_id":"e21ad03b-16e7-40d9-8bb8-bee8d9e026a2","resolution":{"observed_at":"2026-08-12T14:24:12.329810Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:24:11.738944Z","title":"Llmlingua: Com- pressing prompts for accelerated inference of large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15399","last_updated":"2024-11-23T00:51:09Z","snapshot_observed_at":"2026-08-14T12:58:20.383033Z","submitted_at":"2024-11-23T00:51:09Z","title":"Less is More: Optimizing Function Calling for LLM Execution on Edge Devices","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T14:24:11.738944Z"},"links":{"citing_paper":"/paper/2411.15399"},"observation_digest":"sha256:aa2985ec37a47ff5275ad1ac07d473eaa9d4864cf49e32de08c403d59a2bff32","observation_id":"55267f9a-7660-428c-80bb-4e60642a0d9e","resolution":{"observed_at":"2026-08-12T14:24:11.738944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11514","last_updated":"2024-07-30T23:37:20Z","snapshot_observed_at":"2026-08-13T15:23:42.211600Z","submitted_at":"2023-12-12T18:57:08Z","title":"LLM in a flash: Efficient Large Language Model Inference with Limited Memory","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11514","snapshot_observed_at":"2026-08-12T14:24:11.743252Z","title":"Llm in a flash: Efficient large language model inference with limited memory,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15399","last_updated":"2024-11-23T00:51:09Z","snapshot_observed_at":"2026-08-14T12:58:20.383033Z","submitted_at":"2024-11-23T00:51:09Z","title":"Less is More: Optimizing Function Calling for LLM Execution on Edge Devices","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T14:24:11.743252Z"},"links":{"cited_paper":"/paper/2312.11514","citing_paper":"/paper/2411.15399"},"observation_digest":"sha256:f485a40f651027d9e5aeb1559f4a02ad73e3850b1990ccf1a386dec0d878a3ba","observation_id":"4a1720d8-572a-4437-9210-a5837ea39253","resolution":{"observed_at":"2026-08-12T14:24:11.743252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:24:12.301169Z","title":"The breakthrough memory solutions for improved performance on llm inference,","venue":null,"work_id":"52711c06-316e-4928-aae5-4efad45c1bec","year":2024},"citing_paper":{"arxiv_id":"2411.15399","last_updated":"2024-11-23T00:51:09Z","snapshot_observed_at":"2026-08-14T12:58:20.383033Z","submitted_at":"2024-11-23T00:51:09Z","title":"Less is More: Optimizing Function Calling for LLM Execution on Edge Devices","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T14:24:11.748051Z"},"links":{"citing_paper":"/paper/2411.15399"},"observation_digest":"sha256:bbfe7bb41bf351420df699fde233dc2bc08b7cb51aa8b29d3d312a0325b52e17","observation_id":"81407758-574c-4429-9251-36803a75ee20","resolution":{"observed_at":"2026-08-12T14:24:12.305583Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:24:11.752424Z","title":"Specinfer: Accelerating large language model serving with tree-based speculative inference and ver- ification,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.15399","last_updated":"2024-11-23T00:51:09Z","snapshot_observed_at":"2026-08-14T12:58:20.383033Z","submitted_at":"2024-11-23T00:51:09Z","title":"Less is More: Optimizing Function Calling for LLM Execution on Edge Devices","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T14:24:11.752424Z"},"links":{"citing_paper":"/paper/2411.15399"},"observation_digest":"sha256:cdc58c93a8ad40c5980ac39f694a0209f3c5fb5fd4ce211505adddad884fcc66","observation_id":"3df1a72c-8e88-4665-b7fd-56487b67bbdc","resolution":{"observed_at":"2026-08-12T14:24:11.752424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12391","last_updated":"2024-07-17T08:11:47Z","snapshot_observed_at":"2026-08-12T23:20:31.864029Z","submitted_at":"2024-07-17T08:11:47Z","title":"LLM Inference Serving: Survey of Recent Advances and Opportunities","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.12391","snapshot_observed_at":"2026-08-12T14:24:11.756689Z","title":"Llm inference serv- ing: Survey of recent advances and opportunities,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.15399","last_updated":"2024-11-23T00:51:09Z","snapshot_observed_at":"2026-08-14T12:58:20.383033Z","submitted_at":"2024-11-23T00:51:09Z","title":"Less is More: Optimizing Function Calling for LLM Execution on Edge Devices","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T14:24:11.756689Z"},"links":{"cited_paper":"/paper/2407.12391","citing_paper":"/paper/2411.15399"},"observation_digest":"sha256:98a03547d78045f0e7887fbd30adc13de71236435c4c27fc60cfdce78020f230","observation_id":"38b629ae-7512-4a11-9a80-ce79ce060b6c","resolution":{"observed_at":"2026-08-12T14:24:11.756689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:24:12.277446Z","title":"Edge-llm: Enabling efficient large language model adaptation on edge devices via unified compression and adaptive layer voting,","venue":null,"work_id":"f39ab099-af3d-43c1-b000-031e41650038","year":2024},"citing_paper":{"arxiv_id":"2411.15399","last_updated":"2024-11-23T00:51:09Z","snapshot_observed_at":"2026-08-14T12:58:20.383033Z","submitted_at":"2024-11-23T00:51:09Z","title":"Less is More: Optimizing Function Calling for LLM Execution on Edge Devices","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T14:24:11.761524Z"},"links":{"citing_paper":"/paper/2411.15399"},"observation_digest":"sha256:e19c2439fcdf96a99120b332dd06526cd1d71e2f9624629e60ae32974f678089","observation_id":"9f730e71-4728-4c49-86a4-4025a0d49309","resolution":{"observed_at":"2026-08-12T14:24:12.282179Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12031","last_updated":"2024-03-28T17:56:28Z","snapshot_observed_at":"2026-08-09T22:21:33.340392Z","submitted_at":"2024-03-18T17:59:04Z","title":"RouterBench: A Benchmark for Multi-LLM Routing System","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12031","snapshot_observed_at":"2026-08-12T14:24:11.765824Z","title":"Routerbench: A benchmark for multi-llm routing system,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.15399","last_updated":"2024-11-23T00:51:09Z","snapshot_observed_at":"2026-08-14T12:58:20.383033Z","submitted_at":"2024-11-23T00:51:09Z","title":"Less is More: Optimizing Function Calling for LLM Execution on Edge Devices","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T14:24:11.765824Z"},"links":{"cited_paper":"/paper/2403.12031","citing_paper":"/paper/2411.15399"},"observation_digest":"sha256:00c11a5b43cb4e8c16de4a5167a7363b23ccf8b90fb8bf336ce1a07e3044fef5","observation_id":"a76d0449-2218-4f60-b560-dee1763d9fdb","resolution":{"observed_at":"2026-08-12T14:24:11.765824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.05176","last_updated":"2023-05-09T05:11:02Z","snapshot_observed_at":"2026-08-10T11:59:11.481480Z","submitted_at":"2023-05-09T05:11:02Z","title":"FrugalGPT: How to Use Large Language Models While Reducing Cost and Improving Performance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.05176","snapshot_observed_at":"2026-08-12T14:24:11.770217Z","title":"Frugalgpt: How to use large language models while reducing cost and improving performance,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15399","last_updated":"2024-11-23T00:51:09Z","snapshot_observed_at":"2026-08-14T12:58:20.383033Z","submitted_at":"2024-11-23T00:51:09Z","title":"Less is More: Optimizing Function Calling for LLM Execution on Edge Devices","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T14:24:11.770217Z"},"links":{"cited_paper":"/paper/2305.05176","citing_paper":"/paper/2411.15399"},"observation_digest":"sha256:43a99739d43e393df724739d0483d0a38fdae6633f22c7fdd0a8e8ff0936a29a","observation_id":"219adf95-5fa5-4508-ab9f-c2ded0cd7af0","resolution":{"observed_at":"2026-08-12T14:24:11.770217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:24:12.261867Z","title":"Visualwebarena: Evaluating multimodal agents on realistic visual web tasks,","venue":null,"work_id":"59b79c9b-1e0f-409a-b6e0-8c2ab03d1ff6","year":2024},"citing_paper":{"arxiv_id":"2411.15399","last_updated":"2024-11-23T00:51:09Z","snapshot_observed_at":"2026-08-14T12:58:20.383033Z","submitted_at":"2024-11-23T00:51:09Z","title":"Less is More: Optimizing Function Calling for LLM Execution on Edge Devices","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T14:24:11.775069Z"},"links":{"citing_paper":"/paper/2411.15399"},"observation_digest":"sha256:e2907f21f2bf5f692fc5716c7d5540f87084a2d0844c304f8f0c696ec3b2ea4f","observation_id":"ba0a4d2e-abb3-4f7a-b63c-75938f1e56ba","resolution":{"observed_at":"2026-08-12T14:24:12.267210Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06799","last_updated":"2024-09-21T09:10:02Z","snapshot_observed_at":"2026-08-14T10:51:51.702269Z","submitted_at":"2024-06-10T21:08:39Z","title":"LLM-dCache: Improving Tool-Augmented LLMs with GPT-Driven Localized Data Caching","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06799","snapshot_observed_at":"2026-08-12T14:24:11.779275Z","title":"Llm-dcache: Improving tool- augmented llms with gpt-driven localized data caching,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.15399","last_updated":"2024-11-23T00:51:09Z","snapshot_observed_at":"2026-08-14T12:58:20.383033Z","submitted_at":"2024-11-23T00:51:09Z","title":"Less is More: Optimizing Function Calling for LLM Execution on Edge Devices","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T14:24:11.779275Z"},"links":{"cited_paper":"/paper/2406.06799","citing_paper":"/paper/2411.15399"},"observation_digest":"sha256:3ed76c36bc4b50317803a89c313bb2c04718b2f80eb981babea37d54b08826f5","observation_id":"072485c1-ec59-4d85-b4e9-f6a8d3feded1","resolution":{"observed_at":"2026-08-12T14:24:11.779275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17565","last_updated":"2024-12-21T13:55:49Z","snapshot_observed_at":"2026-08-15T06:17:20.332468Z","submitted_at":"2024-06-25T14:02:08Z","title":"MemServe: Context Caching for Disaggregated LLM Serving with Elastic Memory Pool","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17565","snapshot_observed_at":"2026-08-12T14:24:11.783606Z","title":"Memserve: Context caching for disaggregated llm serving with elastic memory pool,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.15399","last_updated":"2024-11-23T00:51:09Z","snapshot_observed_at":"2026-08-14T12:58:20.383033Z","submitted_at":"2024-11-23T00:51:09Z","title":"Less is More: Optimizing Function Calling for LLM Execution on Edge Devices","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T14:24:11.783606Z"},"links":{"cited_paper":"/paper/2406.17565","citing_paper":"/paper/2411.15399"},"observation_digest":"sha256:cc6cc8a484923ca9db2d96d4ed9cbb50eb3d44658c61b341f93333c423455ba9","observation_id":"917577d5-1d66-4f7a-bf1e-4ee08999cd87","resolution":{"observed_at":"2026-08-12T14:24:11.783606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:24:11.787391Z","title":"ToolLLM: Facilitating large language models to master 16000+ real-world APIs,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.15399","last_updated":"2024-11-23T00:51:09Z","snapshot_observed_at":"2026-08-14T12:58:20.383033Z","submitted_at":"2024-11-23T00:51:09Z","title":"Less is More: Optimizing Function Calling for LLM Execution on Edge Devices","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T14:24:11.787391Z"},"links":{"citing_paper":"/paper/2411.15399"},"observation_digest":"sha256:cc3101a2917bfd08a21720ab8b3554cf297ba78dc7345e20bc561c5cde0b82e2","observation_id":"7fb09116-9283-44a7-9e2d-8a2ac5f6607f","resolution":{"observed_at":"2026-08-12T14:24:11.787391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.01549","last_updated":"2026-07-20T02:25:24Z","snapshot_observed_at":"2026-08-13T00:39:42.759722Z","submitted_at":"2024-04-02T01:29:28Z","title":"Octopus: On-device language model for function calling of software APIs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.01549","snapshot_observed_at":"2026-08-12T14:24:11.791121Z","title":"Octopus: On-device language model for function calling of software apis,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.15399","last_updated":"2024-11-23T00:51:09Z","snapshot_observed_at":"2026-08-14T12:58:20.383033Z","submitted_at":"2024-11-23T00:51:09Z","title":"Less is More: Optimizing Function Calling for LLM Execution on Edge Devices","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T14:24:11.791121Z"},"links":{"cited_paper":"/paper/2404.01549","citing_paper":"/paper/2411.15399"},"observation_digest":"sha256:2caf8bdfb2877dcd69d48aa77ac4d4a28d20760eb9285ea8cdad32924ae3e7dd","observation_id":"9816e3c0-8a36-423c-b07e-4fdda0611391","resolution":{"observed_at":"2026-08-12T14:24:11.791121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.04511","last_updated":"2024-06-05T03:53:10Z","snapshot_observed_at":"2026-08-13T05:07:45.070771Z","submitted_at":"2023-12-07T18:32:04Z","title":"An LLM Compiler for Parallel Function Calling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.04511","snapshot_observed_at":"2026-08-12T14:24:11.795177Z","title":"An llm compiler for parallel function calling,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15399","last_updated":"2024-11-23T00:51:09Z","snapshot_observed_at":"2026-08-14T12:58:20.383033Z","submitted_at":"2024-11-23T00:51:09Z","title":"Less is More: Optimizing Function Calling for LLM Execution on Edge Devices","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T14:24:11.795177Z"},"links":{"cited_paper":"/paper/2312.04511","citing_paper":"/paper/2411.15399"},"observation_digest":"sha256:b094286531946ccd6063148f3e202ee394687674fe6f38dba076da913e5d2fed","observation_id":"d88bceaa-cbe4-4ccb-9fe8-bd35db1764b4","resolution":{"observed_at":"2026-08-12T14:24:11.795177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17438","last_updated":"2024-05-07T18:55:50Z","snapshot_observed_at":"2026-08-14T17:09:27.735239Z","submitted_at":"2024-05-07T18:55:50Z","title":"An LLM-Tool Compiler for Fused Parallel Function Calling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17438","snapshot_observed_at":"2026-08-12T14:24:11.799152Z","title":"An llm-tool compiler for fused parallel function calling,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.15399","last_updated":"2024-11-23T00:51:09Z","snapshot_observed_at":"2026-08-14T12:58:20.383033Z","submitted_at":"2024-11-23T00:51:09Z","title":"Less is More: Optimizing Function Calling for LLM Execution on Edge Devices","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T14:24:11.799152Z"},"links":{"cited_paper":"/paper/2405.17438","citing_paper":"/paper/2411.15399"},"observation_digest":"sha256:c7497c236f29d7766a2f660538c3141f1d439d95aac8eecdbb05efeb56b2ace9","observation_id":"432161f8-3806-4356-b44f-f3c74e7d0c70","resolution":{"observed_at":"2026-08-12T14:24:11.799152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:24:11.803769Z","title":"Balancing throughput and fair execution of multi-dnn workloads on heterogeneous embedded devices,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.15399","last_updated":"2024-11-23T00:51:09Z","snapshot_observed_at":"2026-08-14T12:58:20.383033Z","submitted_at":"2024-11-23T00:51:09Z","title":"Less is More: Optimizing Function Calling for LLM Execution on Edge Devices","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T14:24:11.803769Z"},"links":{"citing_paper":"/paper/2411.15399"},"observation_digest":"sha256:6f3318273f5e1b220f073723ea0f8e0269c2afa5f24c90a81a5a55cb7bf1e689","observation_id":"70d15b9c-d2ce-4f96-948e-ab246586757a","resolution":{"observed_at":"2026-08-12T14:24:11.803769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:24:11.807999Z","title":"Geckopt: Llm system efficiency via intent-based tool selection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.15399","last_updated":"2024-11-23T00:51:09Z","snapshot_observed_at":"2026-08-14T12:58:20.383033Z","submitted_at":"2024-11-23T00:51:09Z","title":"Less is More: Optimizing Function Calling for LLM Execution on Edge Devices","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T14:24:11.807999Z"},"links":{"citing_paper":"/paper/2411.15399"},"observation_digest":"sha256:b4e084f11a2d05b680b2e7715505dcd7a633ef40011acae22b2e3f00e268f43d","observation_id":"718861f9-cfe4-49e8-b609-881cd4f9fce7","resolution":{"observed_at":"2026-08-12T14:24:11.807999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:24:11.812045Z","title":"Mapformer: Attention-based multi- dnn manager for throughout & power co-optimization on embedded devices,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.15399","last_updated":"2024-11-23T00:51:09Z","snapshot_observed_at":"2026-08-14T12:58:20.383033Z","submitted_at":"2024-11-23T00:51:09Z","title":"Less is More: Optimizing Function Calling for LLM Execution on Edge Devices","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T14:24:11.812045Z"},"links":{"citing_paper":"/paper/2411.15399"},"observation_digest":"sha256:2d395933564b004068cee3c7e07d67c4fd6eee54c9ee3e7d605d8e63bd5f9692","observation_id":"51c63b47-7422-41c3-85b8-f75dc9627315","resolution":{"observed_at":"2026-08-12T14:24:11.812045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:24:12.206728Z","title":"Contextual retrieval,","venue":null,"work_id":"6b6f774f-261d-4862-8446-fe6337807f6c","year":2024},"citing_paper":{"arxiv_id":"2411.15399","last_updated":"2024-11-23T00:51:09Z","snapshot_observed_at":"2026-08-14T12:58:20.383033Z","submitted_at":"2024-11-23T00:51:09Z","title":"Less is More: Optimizing Function Calling for LLM Execution on Edge Devices","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T14:24:11.816559Z"},"links":{"citing_paper":"/paper/2411.15399"},"observation_digest":"sha256:6de6009114473c1858671bca2b514ac556b5bf9f2448544f04cfefe6869f0f6e","observation_id":"d9df2d4c-b7f0-47ea-8b9e-13a45b4b4f21","resolution":{"observed_at":"2026-08-12T14:24:12.213395Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:24:11.820898Z","title":"Mpnet: Masked and permuted pre-training for language understanding,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.15399","last_updated":"2024-11-23T00:51:09Z","snapshot_observed_at":"2026-08-14T12:58:20.383033Z","submitted_at":"2024-11-23T00:51:09Z","title":"Less is More: Optimizing Function Calling for LLM Execution on Edge Devices","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T14:24:11.820898Z"},"links":{"citing_paper":"/paper/2411.15399"},"observation_digest":"sha256:40a31875a7899996b44220768d49abe0a7fca129d0063f44eaa66582c2a00d69","observation_id":"249ed978-f819-4594-a621-ef7da472eadb","resolution":{"observed_at":"2026-08-12T14:24:11.820898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:24:11.825176Z","title":"Toolqa: A dataset for llm question answering with external tools,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15399","last_updated":"2024-11-23T00:51:09Z","snapshot_observed_at":"2026-08-14T12:58:20.383033Z","submitted_at":"2024-11-23T00:51:09Z","title":"Less is More: Optimizing Function Calling for LLM Execution on Edge Devices","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T14:24:11.825176Z"},"links":{"citing_paper":"/paper/2411.15399"},"observation_digest":"sha256:00c491b8fc712da2a62cd4e5bf55145b0ffe5bc9b68536a85233a011e7475da3","observation_id":"8f2f7527-85f2-4d5e-9217-25c33fa47a90","resolution":{"observed_at":"2026-08-12T14:24:11.825176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:24:12.173328Z","title":"Agglomerative clustering,","venue":null,"work_id":"8606f509-7cb5-4649-ac71-bd23816a590d","year":2024},"citing_paper":{"arxiv_id":"2411.15399","last_updated":"2024-11-23T00:51:09Z","snapshot_observed_at":"2026-08-14T12:58:20.383033Z","submitted_at":"2024-11-23T00:51:09Z","title":"Less is More: Optimizing Function Calling for LLM Execution on Edge Devices","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T14:24:11.829806Z"},"links":{"citing_paper":"/paper/2411.15399"},"observation_digest":"sha256:9b4ce790c31e561c9762b05d559168eee6d667413ddb9611d06cc3f9003e6734","observation_id":"1ca53c91-f511-4334-b117-0c1b0a31270f","resolution":{"observed_at":"2026-08-12T14:24:12.177746Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:24:12.159016Z","title":"The faiss library,","venue":null,"work_id":"373d01ca-973b-419e-a1e4-08efb3ac1d5d","year":2024},"citing_paper":{"arxiv_id":"2411.15399","last_updated":"2024-11-23T00:51:09Z","snapshot_observed_at":"2026-08-14T12:58:20.383033Z","submitted_at":"2024-11-23T00:51:09Z","title":"Less is More: Optimizing Function Calling for LLM Execution on Edge Devices","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T14:24:11.834081Z"},"links":{"citing_paper":"/paper/2411.15399"},"observation_digest":"sha256:39d0e35941d35a723b19ee83124ee4da8bbe02ab9b396a2ffaa27d2266cc5744","observation_id":"b1c7c5e0-9b0c-46a3-909c-daf09e054bde","resolution":{"observed_at":"2026-08-12T14:24:12.163481Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00709","last_updated":"2024-04-23T20:37:24Z","snapshot_observed_at":"2026-08-14T15:52:03.326553Z","submitted_at":"2024-04-23T20:37:24Z","title":"Evaluating Tool-Augmented Agents in Remote Sensing Platforms","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.00709","snapshot_observed_at":"2026-08-12T14:24:11.838514Z","title":"Evaluating tool-augmented agents in remote sensing platforms,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.15399","last_updated":"2024-11-23T00:51:09Z","snapshot_observed_at":"2026-08-14T12:58:20.383033Z","submitted_at":"2024-11-23T00:51:09Z","title":"Less is More: Optimizing Function Calling for LLM Execution on Edge Devices","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T14:24:11.838514Z"},"links":{"cited_paper":"/paper/2405.00709","citing_paper":"/paper/2411.15399"},"observation_digest":"sha256:9913f3fd51fafee251153991c9c05995883f452e558918a5183ba9437219ff48","observation_id":"44b83c18-dfb9-416e-9386-fffb8ccd0348","resolution":{"observed_at":"2026-08-12T14:24:11.838514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:24:12.142402Z","title":"Hermes-2-pro-llama-3-8b,","venue":null,"work_id":"610a312f-8fdd-4ac8-935d-3597be51439e","year":null},"citing_paper":{"arxiv_id":"2411.15399","last_updated":"2024-11-23T00:51:09Z","snapshot_observed_at":"2026-08-14T12:58:20.383033Z","submitted_at":"2024-11-23T00:51:09Z","title":"Less is More: Optimizing Function Calling for LLM Execution on Edge Devices","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T14:24:11.843392Z"},"links":{"citing_paper":"/paper/2411.15399"},"observation_digest":"sha256:4289711d4df935a77f81dfcc323f568fa5e36fffc7f3bebb865137ea2ee3fd87","observation_id":"db6627ec-ca64-4dc7-be4a-266c62871ff4","resolution":{"observed_at":"2026-08-12T14:24:12.149036Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-12T14:24:11.848042Z","title":"The llama 3 herd of models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.15399","last_updated":"2024-11-23T00:51:09Z","snapshot_observed_at":"2026-08-14T12:58:20.383033Z","submitted_at":"2024-11-23T00:51:09Z","title":"Less is More: Optimizing Function Calling for LLM Execution on Edge Devices","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T14:24:11.848042Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2411.15399"},"observation_digest":"sha256:49e8e99a985db27ad4c322e5097047606ae7b1a625aba829953ac81c61288d68","observation_id":"c6548c12-5395-4534-9927-8624ed1ca261","resolution":{"observed_at":"2026-08-12T14:24:11.848042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-12T14:24:11.852686Z","title":"Mistral 7b,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15399","last_updated":"2024-11-23T00:51:09Z","snapshot_observed_at":"2026-08-14T12:58:20.383033Z","submitted_at":"2024-11-23T00:51:09Z","title":"Less is More: Optimizing Function Calling for LLM Execution on Edge Devices","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T14:24:11.852686Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2411.15399"},"observation_digest":"sha256:b9209263ea006bb342e46ccd6ea2c3d3a064d6e8fc89c399582b317eb249b936","observation_id":"cff1a3d4-9d87-4d8d-860e-df816aa5b90d","resolution":{"observed_at":"2026-08-12T14:24:11.852686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-12T14:24:11.857220Z","title":"Qwen2 technical report,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.15399","last_updated":"2024-11-23T00:51:09Z","snapshot_observed_at":"2026-08-14T12:58:20.383033Z","submitted_at":"2024-11-23T00:51:09Z","title":"Less is More: Optimizing Function Calling for LLM Execution on Edge Devices","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T14:24:11.857220Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2411.15399"},"observation_digest":"sha256:2c24d8c4bb8e9449ee288adf59e76dfd73f0c753a2481924eaf72448f2d2830a","observation_id":"3362395f-2013-44b7-93c0-73ebfd468633","resolution":{"observed_at":"2026-08-12T14:24:11.857220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2411.15399","last_updated":"2024-11-23T00:51:09Z","latest_version":1,"primary_category":"cs.PF","snapshot_observed_at":"2026-08-14T12:58:20.383033Z","submitted_at":"2024-11-23T00:51:09Z","title":"Less is More: Optimizing Function Calling for LLM Execution on Edge Devices"},"reference_resolution":{"displayed":45,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":29,"verified_exact":0,"verified_fuzzy":16},"total_outbound_references":45},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 45 of 45 outbound references and 4 inbound Pith citation observations for arXiv:2411.15399."}