Workload
全球 AI Workload,智能
全球 AI Workload,智能路由。
从
告诉我们需要完成什么 AI 任务,而不必先决定购买什么 GPU 或云资源。
MACOMX 根据成本、性能、地域、资源可用性及合规要求,将 AI Workload 匹配至适合的算力、模型与执行基础设施。
- 降低企业 AI 成本
- 为算力带来更多 Workload
- 提升 AI 基础设施利用效率
我们路由的 Workload
不同类型的任务,对底层基础设施的要求各不相同。
AI 智能体
多步骤、反复调用模型与工具的任务,对时延和单次调用成本敏感。
大模型推理
规模化的模型推理服务,按词元计价,受时延与吞吐约束。
编程 AI
代码生成与审查,上下文长、需求集中爆发。
视频与多模态
图像、视频与音频的生成或理解,对显存和带宽要求高。
RAG 与向量计算
基于私有数据的检索、向量化与向量检索,数据所在地往往决定路由。
批量 AI
完成时间灵活、以成本为先的大规模离线任务。
模型微调
用自有数据调整基础模型,需要短期、互联良好的 GPU 资源。
模型训练
预训练与大规模训练,需要长期运行、高速互联的 GPU 集群。
一个 Workload,多种执行方案。
MACOMX 为每个 Workload 建立需求画像、比较可选资源,并路由至合适的执行路径。
- 需求画像
梳理 Workload 的模型、规模、时延、数据所在地与合规约束。
- 资源比较
在算力、模型与地域之间,按成本、性能与可用性比较执行方案。
- 智能路由
将 Workload 分配至满足其要求的执行路径。
- 执行交付
Workload 按约定执行,交付结果按约定条款核对。
提交 Workload
描述你需要达成的结果即可,模型、硬件与地域可以一起确定。