密瓜智能 × 清程极智合作
密瓜智能 × 清程极智:为企业级大模型应用提供"调度 + 基建"一体化解决方案
近日,密瓜智能与清程极智在北京宣布达成战略合作,双方直指 AI 产业异构算力调度效率困境,为企业级大模型应用提供了"调度 + 基建"一体化解决方案。
来自我们团队的见解、教程和新闻
近日,密瓜智能与清程极智在北京宣布达成战略合作,双方直指 AI 产业异构算力调度效率困境,为企业级大模型应用提供了"调度 + 基建"一体化解决方案。
近日,云原生与开源领域资深技术人宋净超(Jimmy Song)正式加入密瓜智能,出任开源生态 VP,助力密瓜智能在 AI 原生基础设施生态建设、全球开发者协作领域的布局。
专注于异构算力调度和虚拟化的 AI 初创企业上海密瓜智能科技有限公司已于近期完成数千万元的天使轮融资,本轮融资由复星创富领投,拙朴投资、种子投资人及产业方强力跟投。
12 月 27 日,「不卷算力卷效率|HAMi Meetup 北京站」在北京海淀区圆满落幕。近百位技术伙伴齐聚,围绕异构算力虚拟化、调度策略演进、AI 业务效率提升等关键议题展开深入交流。
本次 HAMi Meetup 于 11 月 30 日在上海成功举办,围绕「不卷算力卷效率」主题,聚焦 GPU 虚拟化与异构算力调度实践。来自 CNCF 及多家企业的专家分享了 HAMi 在调度可观测性、GPU 共享、国产算力适配与云原生 AI 基建方面的最新进展与落地经验。
深度解析 HAMi v2.7.0 如何实现对亚马逊云科技 Trainium 与 Inferentia 芯片的核心级共享与策略性拓扑调度,通过基于先验知识的调度算法,在保持性能稳定的同时显著降低管理成本。
Xinference 通过 Helm Chart 原生支持 HAMi vGPU,让多模型推理平台实现 GPU 安全共享、精细配额和统一治理。本文详细介绍如何一键启用 HAMi vGPU,以及在生产环境中实现降本增效的最佳实践。
HAMi v2.7.0 针对原生 Kubernetes ResourceQuota 在 GPU 等异构算力场景下的局限性,推出了扩展 ResourceQuota 机制。本文深入代码实现,详细剖析 HAMi 如何解决资源关联和动态资源两大痛点,为多租户环境提供精准的 GPU 资源配额管理。
HAMi 通过精心设计的设备抽象层,为异构算力的快速集成提供了优雅的解决方案。本文深入解析这一核心架构,并以 v2.7.0 版本中集成的燧原 GCU 为例,展示厂商或社区开发者如何基于此架构快速实现对新硬件的支持。
获取最新的技术文章、教程和 HAMi 社区更新。