微软发布公告:Fireworks AI在Microsoft Foundry部署Kimi K3模型
模型。应用与智能体(Agent)开发平台。应用。推理与微调。全球负责人),总部位于美国加州。万亿个参数,是目前最大的开放模型之一。部完整的小说或一个完整的代码库)。模型名称部署类型输入输出缓存输入元人民币)元人民币)元人民币)
微软Azure迎来国产大模型新成员
7月28日, 微软官方发布了公告, 随后标明, 用户如今能够借助Fireworks AI于微软Azure上部署月之暗面的Kimi K3模型。这一情况意味国产大模型头一回以官方合作的形式进入微软企业级AI平台。Kimi K3具备2.8万亿参数, 是当前开放模型里体量颇具之规模, 它的上下文窗口达到100万Token, 单次请求能够处理大约75万个单词, 等同于如等同于10部长篇小说那么多的单词量或者一个完整代码库的单词量。
微软推出的企业级AI应用与智能体开发平台Azure, 把模型管理、智能体构建、安全治理以及可观测性统一集成于云原生架构里。此次合作使得国内开发者能够直接于Azure上调用Kimi K3, 不必额外搭建推理环境, 降低了企业运用国产大模型的门槛。
Fireworks AI是谁
Fireworks AI是一个云服务平台, 它专注于生成式AI推理与微调, 它在2022年由前Meta核心团队成员创立, CEO林徹曾担任Meta全球负责人, 公司总部处于美国加州, 这家公司主打极致速度以及性价比, 它在AI推理优化领域积累起了深厚技术实力。
Fireworks AI跟微软过往并非未合作过, 之前就已助力多个开源模型于Azure上开展部署, 此次引入Kimi K3, 进一步使Azure平台那模型生态变得丰富, 致使企业用户于挑选大模型之际有多一些国产选择的条件与机会, 使之有此可能且有更多相应国产选项可挑。
Kimi K3价格到底贵不贵
依据微软予以公布的定价情形而言, Kimi K3在Azure之上的部署时价格存有三档, 其一为, 输入每100万Token的收费是3.30美元, 此约合22.4元人民币;其二为, 输出每100万Token收取费用达16.50美元, 粗略换算约合111.8元人民币;还有其三, 缓存输入时每100万Token只需支付区区0 point 33美元这般, 大约折合2.2元人民币。
与当下主流大模型的定价比较, Kimi K3 的输出价格处在中高水平, 不过考量其 2.8 万亿参数的规模以及 100 万 Token 的极长上下文, 对于那些有对待海量文档、代码库需求的企业来讲, 性价比依旧显著, 缓存输入的低价举措也能对高频调用场景极大程度降低成本。
企业能用Kimi K3做什么
Kimi K3有着那个超长的上下文窗口, 从而使得它在去处理长文档、代码审查、法律合同等的这么一些场景之中具有天然的优势。比如说律师事务所能够借助它一次性针对数百页的合同文本展开分析。再说软件公司能够输入整个代码库好使模型去进行漏洞检测以及给出优化建议。
在Azure这个平台之上, 去部署Kimi K3, 企业呢, 还能够把Azure自身所具备的AI治理以及安全功能给结合起来。对于开发者而言, 可以借助Azure的统一接口去管理模型调用情况, 也就是怎么样去监控使用状况, 还要去设定访问权限, 以此来确保AI应用与企业合规要求相契合。
国产大模型出海的新路径
此次合作, 为国产大模型出海给出了一种不一样的思路, 借助Fireworks AI这类中间服务商, 国产模型得以避开海外市场的地域限制, 直接接触到Azure的全球企业客户。属于月之暗面旗舰模型的Kimi K3, 选择这样的路径, 不仅能够迅速获得海外用户, 还能凭借Azure的品牌背书来提高可信度。
对月之暗面而言, 此次合作不只是技术输出方面的一种尝试, 更是商业模式领域的一番探索。借助第三方平台去分发模型, 能够规避自建海外基础设施所产生的高昂成本, 与此同时还能测试海外市场对国产大模型的接受程度。
开发者怎么快速上手
如果你身为企业开发者, 欲即刻体验Kimi K3, 那么可径直登录Azure AI Foundry, 于模型目录之中搜寻Kimi K3, 选取Fireworks AI作为部署服务商, 待配置好API密钥之后, 便能够借助标准的OpenAI兼容接口来调用模型, 当前的现有代码基本毋需改动。
微软给出了详尽的部署文档, 还提供了示例代码, 以此助开发者处理上下文窗口配置、缓存策略优化等细节;对于所需私有化部署的企业呢, 还能够经由Azure的专属资源池申领独立实例, 确保数据不在企业边界之外。
置于Azure之上用以处置长文档之情景的Kimi K3, 你身处的那家企业会予以思量吗? 于评论区去分享你的见解吧, 为这篇文章进行点赞以及开展转发行径以使更多的人明了国产大模型的最新进展情况。