{"as_of":"2026-08-08T21:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9b4ef3881900406b526de7fcc56ee6d0b8b38d7fc0d054e6910e321df11b9e67","coverage":[{"denominator":27,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T19:21:36.407060Z","state":"measured"},{"denominator":27,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":27,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2512.01039/citation-record","integrity":"/paper/2512.01039/integrity","json":"/paper/2512.01039/citation-record.json","paper":"/paper/2512.01039"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:21:36.335119Z","title":"Large Language Model (LLM) for Telecommunications: A Comprehensive Survey on Principles, Key Techniques, and Opportunities,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.01039","last_updated":"2025-11-30T19:16:30Z","snapshot_observed_at":"2026-08-07T14:55:02.267471Z","submitted_at":"2025-11-30T19:16:30Z","title":"Joint Partitioning and Placement of Foundation Models for Real-Time Edge AI","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T19:21:36.335119Z"},"links":{"citing_paper":"/paper/2512.01039"},"observation_digest":"sha256:c280f7de767c1a79e8c9ecc075368b3a073008a146b26f0d2c7b5738deea1034","observation_id":"8216d598-8a57-48ed-ae48-ae1e280ca7d7","resolution":{"observed_at":"2026-08-03T19:21:36.335119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12391","last_updated":"2024-07-17T08:11:47Z","snapshot_observed_at":"2026-07-06T18:47:37.971415Z","submitted_at":"2024-07-17T08:11:47Z","title":"LLM Inference Serving: Survey of Recent Advances and Opportunities","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.12391","snapshot_observed_at":"2026-08-03T19:21:36.338737Z","title":"LLM Inference Serv- ing: Survey of Recent Advances and Opportunities,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.01039","last_updated":"2025-11-30T19:16:30Z","snapshot_observed_at":"2026-08-07T14:55:02.267471Z","submitted_at":"2025-11-30T19:16:30Z","title":"Joint Partitioning and Placement of Foundation Models for Real-Time Edge AI","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T19:21:36.338737Z"},"links":{"cited_paper":"/paper/2407.12391","citing_paper":"/paper/2512.01039"},"observation_digest":"sha256:122d81ff84f837f69e376e53ddf3ee1ad356b90abdc73341279d83a3dc56e50c","observation_id":"20add637-256d-4981-9a22-d17ebf81041d","resolution":{"observed_at":"2026-08-03T19:21:36.338737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:21:36.342033Z","title":"Split computing: DNN Inference Partition with Load Balancing in IoT-Edge Platform for Beyond 5G,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2512.01039","last_updated":"2025-11-30T19:16:30Z","snapshot_observed_at":"2026-08-07T14:55:02.267471Z","submitted_at":"2025-11-30T19:16:30Z","title":"Joint Partitioning and Placement of Foundation Models for Real-Time Edge AI","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T19:21:36.342033Z"},"links":{"citing_paper":"/paper/2512.01039"},"observation_digest":"sha256:f63c8f45d084215526b76197e3b62bb2d5f9c03b3a78b22911dbb2f74d6656bc","observation_id":"f6917c7a-b1fd-4f75-bc58-246354d94e56","resolution":{"observed_at":"2026-08-03T19:21:36.342033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:21:36.344746Z","title":"Split Computing: Dynamic Partitioning and Reliable Communications in IoT-Edge for 6G Vision,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2512.01039","last_updated":"2025-11-30T19:16:30Z","snapshot_observed_at":"2026-08-07T14:55:02.267471Z","submitted_at":"2025-11-30T19:16:30Z","title":"Joint Partitioning and Placement of Foundation Models for Real-Time Edge AI","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T19:21:36.344746Z"},"links":{"citing_paper":"/paper/2512.01039"},"observation_digest":"sha256:695567690f6fdacd709d4a8297e9942a2093ab503609d35c949109860b6bb8bf","observation_id":"fc4a42ff-8e4c-4383-9c99-e339d57c5b9e","resolution":{"observed_at":"2026-08-03T19:21:36.344746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:21:36.347755Z","title":"Kubernetes and Docker Load Balancing: State-of-the-Art Techniques and Challenges,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.01039","last_updated":"2025-11-30T19:16:30Z","snapshot_observed_at":"2026-08-07T14:55:02.267471Z","submitted_at":"2025-11-30T19:16:30Z","title":"Joint Partitioning and Placement of Foundation Models for Real-Time Edge AI","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T19:21:36.347755Z"},"links":{"citing_paper":"/paper/2512.01039"},"observation_digest":"sha256:44415b384151aa21007e8dd7668d50a48b0c0b91c4805202820f79f93706b5a0","observation_id":"ac70b13b-be07-4bf7-bcf0-08ec743d5c72","resolution":{"observed_at":"2026-08-03T19:21:36.347755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.04417","last_updated":"2021-09-22T05:05:56Z","snapshot_observed_at":"2026-07-06T11:36:58.215745Z","submitted_at":"2021-08-10T02:58:31Z","title":"Privacy-Preserving Machine Learning: Methods, Challenges and Directions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.04417","snapshot_observed_at":"2026-08-03T19:21:36.350529Z","title":"Privacy-Preserving Machine Learning: Methods, Challenges and Directions,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2512.01039","last_updated":"2025-11-30T19:16:30Z","snapshot_observed_at":"2026-08-07T14:55:02.267471Z","submitted_at":"2025-11-30T19:16:30Z","title":"Joint Partitioning and Placement of Foundation Models for Real-Time Edge AI","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T19:21:36.350529Z"},"links":{"cited_paper":"/paper/2108.04417","citing_paper":"/paper/2512.01039"},"observation_digest":"sha256:a1b0906a7966739b68851d9584315412d1458a1edef1f50c5982db6ded12f042","observation_id":"61eb1354-c5ce-4133-a0a0-1283f41d4443","resolution":{"observed_at":"2026-08-03T19:21:36.350529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:21:36.353724Z","title":"Edge Artificial Intelligence for 6G: Vision, Enabling Technologies, and Applications,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2512.01039","last_updated":"2025-11-30T19:16:30Z","snapshot_observed_at":"2026-08-07T14:55:02.267471Z","submitted_at":"2025-11-30T19:16:30Z","title":"Joint Partitioning and Placement of Foundation Models for Real-Time Edge AI","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T19:21:36.353724Z"},"links":{"citing_paper":"/paper/2512.01039"},"observation_digest":"sha256:b6d1fd622a6d3d0d331d812be44813cf8c810972b81d8933b06a5329b6a61829","observation_id":"c1e0e05a-7238-479b-9caf-ea5c441c5c52","resolution":{"observed_at":"2026-08-03T19:21:36.353724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:21:36.356261Z","title":"Kubernetes Scheduling: Taxonomy, Ongoing Issues and Challenges,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2512.01039","last_updated":"2025-11-30T19:16:30Z","snapshot_observed_at":"2026-08-07T14:55:02.267471Z","submitted_at":"2025-11-30T19:16:30Z","title":"Joint Partitioning and Placement of Foundation Models for Real-Time Edge AI","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T19:21:36.356261Z"},"links":{"citing_paper":"/paper/2512.01039"},"observation_digest":"sha256:643038314eece4f633f9ac6c39ca2343a6416fb0a3abd04c7ce71344fbd46f44","observation_id":"b48f33f7-bf1c-4604-b85d-b5c34c413b8f","resolution":{"observed_at":"2026-08-03T19:21:36.356261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.20018","last_updated":"2024-07-29T13:53:27Z","snapshot_observed_at":"2026-07-06T18:53:22.585501Z","submitted_at":"2024-07-29T13:53:27Z","title":"Efficient Training of Large Language Models on Distributed Infrastructures: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.20018","snapshot_observed_at":"2026-08-03T19:21:36.358858Z","title":"Efficient Training of Large Language Models on Distributed Infrastructures: A Survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.01039","last_updated":"2025-11-30T19:16:30Z","snapshot_observed_at":"2026-08-07T14:55:02.267471Z","submitted_at":"2025-11-30T19:16:30Z","title":"Joint Partitioning and Placement of Foundation Models for Real-Time Edge AI","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T19:21:36.358858Z"},"links":{"cited_paper":"/paper/2407.20018","citing_paper":"/paper/2512.01039"},"observation_digest":"sha256:862c78c9ff371051d0ae7becf858742d2c9bf58441360e90a4fd69be8b91dea3","observation_id":"00f2ef55-9fe8-4264-96dc-1c6bd9358894","resolution":{"observed_at":"2026-08-03T19:21:36.358858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:21:36.361753Z","title":"A Comprehensive Study on Quantiza- tion Techniques for Large Language Models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.01039","last_updated":"2025-11-30T19:16:30Z","snapshot_observed_at":"2026-08-07T14:55:02.267471Z","submitted_at":"2025-11-30T19:16:30Z","title":"Joint Partitioning and Placement of Foundation Models for Real-Time Edge AI","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T19:21:36.361753Z"},"links":{"citing_paper":"/paper/2512.01039"},"observation_digest":"sha256:6d18042507fa5163bf9144dadffdd08528d82b7cb688be6fed72593cb68d3044","observation_id":"9e43b617-f1f4-435b-9ea9-c0f8388b17c4","resolution":{"observed_at":"2026-08-03T19:21:36.361753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14294","last_updated":"2024-07-19T04:47:36Z","snapshot_observed_at":"2026-07-06T18:03:47.096406Z","submitted_at":"2024-04-22T15:53:08Z","title":"A Survey on Efficient Inference for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14294","snapshot_observed_at":"2026-08-03T19:21:36.364206Z","title":"A Survey on Efficient Inference for Large Language Models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.01039","last_updated":"2025-11-30T19:16:30Z","snapshot_observed_at":"2026-08-07T14:55:02.267471Z","submitted_at":"2025-11-30T19:16:30Z","title":"Joint Partitioning and Placement of Foundation Models for Real-Time Edge AI","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T19:21:36.364206Z"},"links":{"cited_paper":"/paper/2404.14294","citing_paper":"/paper/2512.01039"},"observation_digest":"sha256:8f18a790afc42099b6d496d5934c2cabd3c46e23ea2ac90bcbf674483d841acd","observation_id":"d450304e-ad3b-43a8-b7dd-239e9f803329","resolution":{"observed_at":"2026-08-03T19:21:36.364206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.02336","last_updated":"2024-04-29T04:51:05Z","snapshot_observed_at":"2026-07-06T18:09:34.170798Z","submitted_at":"2024-04-29T04:51:05Z","title":"Artificial General Intelligence (AGI)-Native Wireless Systems: A Journey Beyond 6G","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.02336","snapshot_observed_at":"2026-08-03T19:21:36.367075Z","title":"Artificial General Intelligence (AGI)- Native Wireless Systems: A Journey Beyond 6G,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.01039","last_updated":"2025-11-30T19:16:30Z","snapshot_observed_at":"2026-08-07T14:55:02.267471Z","submitted_at":"2025-11-30T19:16:30Z","title":"Joint Partitioning and Placement of Foundation Models for Real-Time Edge AI","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T19:21:36.367075Z"},"links":{"cited_paper":"/paper/2405.02336","citing_paper":"/paper/2512.01039"},"observation_digest":"sha256:2b00d5f7e8fb251b6d56a4e58ac6a836cdbd64f0375fb2d12310cbe6cfc84fbb","observation_id":"ddfb6079-cf7d-4805-b586-f3779c248fea","resolution":{"observed_at":"2026-08-03T19:21:36.367075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:21:36.369792Z","title":"Dis- tributed Inference Acceleration with Adaptive DNN Partitioning and Offloading,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2512.01039","last_updated":"2025-11-30T19:16:30Z","snapshot_observed_at":"2026-08-07T14:55:02.267471Z","submitted_at":"2025-11-30T19:16:30Z","title":"Joint Partitioning and Placement of Foundation Models for Real-Time Edge AI","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T19:21:36.369792Z"},"links":{"citing_paper":"/paper/2512.01039"},"observation_digest":"sha256:41a89acbfb623be8ad02f13b330ddcef86e6d6be54e1884edf44b63a5093f2b6","observation_id":"38ca4314-a64e-4fdc-875a-5d61552b3ab3","resolution":{"observed_at":"2026-08-03T19:21:36.369792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16739","last_updated":"2025-06-04T07:22:47Z","snapshot_observed_at":"2026-08-03T22:38:00.596602Z","submitted_at":"2023-09-28T06:22:59Z","title":"Pushing Large Language Models to the 6G Edge: Vision, Challenges, and Opportunities","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16739","snapshot_observed_at":"2026-08-03T19:21:36.372302Z","title":"Pushing Large Language Models to the 6G Edge: Vision, Challenges, and Opportunities,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.01039","last_updated":"2025-11-30T19:16:30Z","snapshot_observed_at":"2026-08-07T14:55:02.267471Z","submitted_at":"2025-11-30T19:16:30Z","title":"Joint Partitioning and Placement of Foundation Models for Real-Time Edge AI","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T19:21:36.372302Z"},"links":{"cited_paper":"/paper/2309.16739","citing_paper":"/paper/2512.01039"},"observation_digest":"sha256:0f334587099c5b5996231b5e9c4e09eddfd0695624061adf106fa2ab1f361e7b","observation_id":"3d82a2e8-586a-417b-aa5e-aae6911767d5","resolution":{"observed_at":"2026-08-03T19:21:36.372302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:21:36.375195Z","title":"EdgeShard: Efficient LLM Inference via Collaborative Edge Computing,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.01039","last_updated":"2025-11-30T19:16:30Z","snapshot_observed_at":"2026-08-07T14:55:02.267471Z","submitted_at":"2025-11-30T19:16:30Z","title":"Joint Partitioning and Placement of Foundation Models for Real-Time Edge AI","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T19:21:36.375195Z"},"links":{"citing_paper":"/paper/2512.01039"},"observation_digest":"sha256:53a384eb44eb4050de553039abd7ed431449e4ddbb711fb09d1925751d3bfc34","observation_id":"c9a1dc9c-d41d-48e3-82b1-a5021d912b48","resolution":{"observed_at":"2026-08-03T19:21:36.375195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:21:36.377867Z","title":"QoS-Aware Edge AI Placement and Scheduling with Multiple Implementations in FaaS-Based Edge Computing,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.01039","last_updated":"2025-11-30T19:16:30Z","snapshot_observed_at":"2026-08-07T14:55:02.267471Z","submitted_at":"2025-11-30T19:16:30Z","title":"Joint Partitioning and Placement of Foundation Models for Real-Time Edge AI","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T19:21:36.377867Z"},"links":{"citing_paper":"/paper/2512.01039"},"observation_digest":"sha256:604c96b68121444862e7f3246d8b9b01a67c27fe2ab439b56606d731ddfd560f","observation_id":"9d76689c-782e-481a-9fca-e00056a938c1","resolution":{"observed_at":"2026-08-03T19:21:36.377867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02616","last_updated":"2024-09-11T11:59:25Z","snapshot_observed_at":"2026-08-06T03:14:39.296335Z","submitted_at":"2024-06-03T09:41:42Z","title":"Adaptive Layer Splitting for Wireless LLM Inference in Edge Computing: A Model-Based Reinforcement Learning Approach","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02616","snapshot_observed_at":"2026-08-03T19:21:36.380653Z","title":"Adaptive Layer Splitting for Wireless LLM Inference in Edge Computing: A Model- Based Reinforcement Learning Approach,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.01039","last_updated":"2025-11-30T19:16:30Z","snapshot_observed_at":"2026-08-07T14:55:02.267471Z","submitted_at":"2025-11-30T19:16:30Z","title":"Joint Partitioning and Placement of Foundation Models for Real-Time Edge AI","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T19:21:36.380653Z"},"links":{"cited_paper":"/paper/2406.02616","citing_paper":"/paper/2512.01039"},"observation_digest":"sha256:df44c0597571b9a6167bf949752cc4be5178cf06eaeb48ff8482cf7a956f9247","observation_id":"6410cd9d-fef6-41ee-8347-2c38598d79ec","resolution":{"observed_at":"2026-08-03T19:21:36.380653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:21:36.383418Z","title":"Distributing Deep Neural Networks with Containerized Partitions at the Edge,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2512.01039","last_updated":"2025-11-30T19:16:30Z","snapshot_observed_at":"2026-08-07T14:55:02.267471Z","submitted_at":"2025-11-30T19:16:30Z","title":"Joint Partitioning and Placement of Foundation Models for Real-Time Edge AI","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T19:21:36.383418Z"},"links":{"citing_paper":"/paper/2512.01039"},"observation_digest":"sha256:26b7f29d0b3192a6976ed7198257b6ba291e8c5f760e8bd9e30dc5b05576a28a","observation_id":"93df8240-a0b4-4437-a2c2-d5f4f7d698ce","resolution":{"observed_at":"2026-08-03T19:21:36.383418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:21:36.385794Z","title":"Learning- Aided Computation Offloading for Trusted Collaborative Mobile Edge Computing,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2512.01039","last_updated":"2025-11-30T19:16:30Z","snapshot_observed_at":"2026-08-07T14:55:02.267471Z","submitted_at":"2025-11-30T19:16:30Z","title":"Joint Partitioning and Placement of Foundation Models for Real-Time Edge AI","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T19:21:36.385794Z"},"links":{"citing_paper":"/paper/2512.01039"},"observation_digest":"sha256:da4859bb56140e591efe24be553f1eaa69598a10fbf6f54368cbf04df07203b1","observation_id":"1afb0cd4-911c-4c29-b7e1-cfb71fe3d497","resolution":{"observed_at":"2026-08-03T19:21:36.385794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:21:36.388327Z","title":"Optimal AI Model Splitting and Resource Allocation for Device-Edge Co-Inference in Multi-User Wireless Sensing Systems,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.01039","last_updated":"2025-11-30T19:16:30Z","snapshot_observed_at":"2026-08-07T14:55:02.267471Z","submitted_at":"2025-11-30T19:16:30Z","title":"Joint Partitioning and Placement of Foundation Models for Real-Time Edge AI","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T19:21:36.388327Z"},"links":{"citing_paper":"/paper/2512.01039"},"observation_digest":"sha256:a26808b648a962a9a96d241b9485f90b5182c617540293d525c2ecb27b708f0c","observation_id":"13ea0520-2e0a-4513-8cff-b3550b4a0602","resolution":{"observed_at":"2026-08-03T19:21:36.388327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:21:36.390708Z","title":"Optimum Splitting Comput- ing for DNN Training Through Next Generation Smart Networks: A Multi-Tier Deep Reinforcement Learning Approach,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.01039","last_updated":"2025-11-30T19:16:30Z","snapshot_observed_at":"2026-08-07T14:55:02.267471Z","submitted_at":"2025-11-30T19:16:30Z","title":"Joint Partitioning and Placement of Foundation Models for Real-Time Edge AI","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T19:21:36.390708Z"},"links":{"citing_paper":"/paper/2512.01039"},"observation_digest":"sha256:0fbb8a9c1d404ffab748243101a8447aaad6765df809264900238de1eab4a745","observation_id":"5bb3fa16-d3d5-4a07-aa06-0e565dd6ab42","resolution":{"observed_at":"2026-08-03T19:21:36.390708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:21:36.393109Z","title":"R-SFLLM: Jamming Resilient Framework for Split Federated Learning with Large Language Models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.01039","last_updated":"2025-11-30T19:16:30Z","snapshot_observed_at":"2026-08-07T14:55:02.267471Z","submitted_at":"2025-11-30T19:16:30Z","title":"Joint Partitioning and Placement of Foundation Models for Real-Time Edge AI","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-03T19:21:36.393109Z"},"links":{"citing_paper":"/paper/2512.01039"},"observation_digest":"sha256:876815baf3dbfdf126283162c528eadc2b4ff2c8a4c56f77dd32616369b3f99b","observation_id":"cff130e0-866d-4c88-80dd-7ad0979bab07","resolution":{"observed_at":"2026-08-03T19:21:36.393109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.17239","last_updated":"2026-04-23T09:56:57Z","snapshot_observed_at":"2026-07-06T20:56:44.975733Z","submitted_at":"2025-03-21T15:44:09Z","title":"SafeMERGE: Preserving Safety Alignment in Fine-Tuned Large Language Models via Selective Layer-Wise Model Merging","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.17239","snapshot_observed_at":"2026-08-03T19:21:36.395661Z","title":"SafeMERGE: Preserving Safety Alignment in Fine-Tuned Large Language Models via Selective Layer-Wise Model Merging,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.01039","last_updated":"2025-11-30T19:16:30Z","snapshot_observed_at":"2026-08-07T14:55:02.267471Z","submitted_at":"2025-11-30T19:16:30Z","title":"Joint Partitioning and Placement of Foundation Models for Real-Time Edge AI","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T19:21:36.395661Z"},"links":{"cited_paper":"/paper/2503.17239","citing_paper":"/paper/2512.01039"},"observation_digest":"sha256:e5dd58012d3b86211f72700bcb70712970a9d405f6482c8d13b244d55e1df474","observation_id":"a710f362-3967-4539-899e-653a7358a0ee","resolution":{"observed_at":"2026-08-03T19:21:36.395661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.00407","last_updated":"2025-04-04T04:28:20Z","snapshot_observed_at":"2026-08-07T16:18:37.525337Z","submitted_at":"2025-04-01T04:08:37Z","title":"AMP4EC: Adaptive Model Partitioning Framework for Efficient Deep Learning Inference in Edge Computing Environments","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.00407","snapshot_observed_at":"2026-08-03T19:21:36.398905Z","title":"AMP4EC: Adaptive Model Partitioning Framework for Efficient Deep Learning Inference in Edge Computing Environments,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.01039","last_updated":"2025-11-30T19:16:30Z","snapshot_observed_at":"2026-08-07T14:55:02.267471Z","submitted_at":"2025-11-30T19:16:30Z","title":"Joint Partitioning and Placement of Foundation Models for Real-Time Edge AI","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-03T19:21:36.398905Z"},"links":{"cited_paper":"/paper/2504.00407","citing_paper":"/paper/2512.01039"},"observation_digest":"sha256:71b805f0fd879ec2fd4ed52fbabfc8f0643deb189107327094794efb2a8fa217","observation_id":"376262f6-7131-46cd-a47c-c6aa1471197a","resolution":{"observed_at":"2026-08-03T19:21:36.398905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.10635","last_updated":"2022-05-21T16:24:47Z","snapshot_observed_at":"2026-07-06T13:12:24.695640Z","submitted_at":"2022-05-21T16:24:47Z","title":"SplitPlace: AI Augmented Splitting and Placement of Large-Scale Neural Networks in Mobile Edge Environments","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.10635","snapshot_observed_at":"2026-08-03T19:21:36.401798Z","title":"SplitPlace: AI Augmented Splitting and Placement of Large-Scale Neural Networks in Mobile Edge Environments,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2512.01039","last_updated":"2025-11-30T19:16:30Z","snapshot_observed_at":"2026-08-07T14:55:02.267471Z","submitted_at":"2025-11-30T19:16:30Z","title":"Joint Partitioning and Placement of Foundation Models for Real-Time Edge AI","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T19:21:36.401798Z"},"links":{"cited_paper":"/paper/2205.10635","citing_paper":"/paper/2512.01039"},"observation_digest":"sha256:111b9af870cc32ca86188b05f6a7f7a62d21a55652fdd34fc507f108dca481f5","observation_id":"6db1e5f4-2a7d-4ed1-88e6-47a0a5ff337a","resolution":{"observed_at":"2026-08-03T19:21:36.401798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.05739","last_updated":"2024-02-01T13:01:25Z","snapshot_observed_at":"2026-08-07T18:16:58.166648Z","submitted_at":"2023-11-09T20:52:36Z","title":"Adaptive Compression-Aware Split Learning and Inference for Enhanced Network Efficiency","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.05739","snapshot_observed_at":"2026-08-03T19:21:36.404378Z","title":"Adaptive Compression-Aware Split Learning and Inference for Enhanced Network Efficiency,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.01039","last_updated":"2025-11-30T19:16:30Z","snapshot_observed_at":"2026-08-07T14:55:02.267471Z","submitted_at":"2025-11-30T19:16:30Z","title":"Joint Partitioning and Placement of Foundation Models for Real-Time Edge AI","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-03T19:21:36.404378Z"},"links":{"cited_paper":"/paper/2311.05739","citing_paper":"/paper/2512.01039"},"observation_digest":"sha256:3b32cc9240ce027d8e81c5efcef53e6d5a8fe9e7eb1ece88d53a0015b0a9931f","observation_id":"fd035a8c-59be-4f59-b43c-7d34c5800149","resolution":{"observed_at":"2026-08-03T19:21:36.404378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-03T19:21:36.407060Z","title":"The Llama 3 Herd of Models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.01039","last_updated":"2025-11-30T19:16:30Z","snapshot_observed_at":"2026-08-07T14:55:02.267471Z","submitted_at":"2025-11-30T19:16:30Z","title":"Joint Partitioning and Placement of Foundation Models for Real-Time Edge AI","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-03T19:21:36.407060Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2512.01039"},"observation_digest":"sha256:7d7026f7a5199f92759b0684433d5c3a5ef3393afec5b9409681cb6bcfcc283c","observation_id":"26a4e151-b4d4-48f7-a68b-8e42880f54c9","resolution":{"observed_at":"2026-08-03T19:21:36.407060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2512.01039","last_updated":"2025-11-30T19:16:30Z","latest_version":1,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-07T14:55:02.267471Z","submitted_at":"2025-11-30T19:16:30Z","title":"Joint Partitioning and Placement of Foundation Models for Real-Time Edge AI"},"reference_resolution":{"displayed":27,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":27,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":27},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 27 of 27 outbound references and 0 inbound Pith citation observations for arXiv:2512.01039."}