kimi(月之暗面)放大招了!#ai创造营#
开源了 1T 参数的 K2 模型,具备极强的代码生成和 Agentic 能力。
我正在测试相信我,代码能力不会让你失望!
基准测试中取得开源模型 SOTA成绩,尤其在代码、Agent、数学推理任务上表现突出。
价格也非常便宜,每百万输入 4 元,输出 16 元。
现在可以在 kimi 体验
模型训练细节:
预训练阶段使用 MuonClip 优化器,替代传统 Adam,提升了大规模模型训练的稳定性和 token 利用效率。
支持 15.5T token 的平稳训练,无 loss spike,提升了模型的可扩展性。
构建了覆盖数百领域、数千工具的多轮工具使用场景合成 pipeline,提升了模型在复杂任务中的泛化能力。
引入自我评价机制的通用强化学习,解决不可验证任务的奖励稀缺问题,提升泛化任务表现。
支持 OpenAI 和 Anthropic 两种 API 格式,兼容主流推理引擎(如 vLLM、SGLang、ktransformers),易于集成和部署。
开源了 1T 参数的 K2 模型,具备极强的代码生成和 Agentic 能力。
我正在测试相信我,代码能力不会让你失望!
基准测试中取得开源模型 SOTA成绩,尤其在代码、Agent、数学推理任务上表现突出。
价格也非常便宜,每百万输入 4 元,输出 16 元。
现在可以在 kimi 体验
模型训练细节:
预训练阶段使用 MuonClip 优化器,替代传统 Adam,提升了大规模模型训练的稳定性和 token 利用效率。
支持 15.5T token 的平稳训练,无 loss spike,提升了模型的可扩展性。
构建了覆盖数百领域、数千工具的多轮工具使用场景合成 pipeline,提升了模型在复杂任务中的泛化能力。
引入自我评价机制的通用强化学习,解决不可验证任务的奖励稀缺问题,提升泛化任务表现。
支持 OpenAI 和 Anthropic 两种 API 格式,兼容主流推理引擎(如 vLLM、SGLang、ktransformers),易于集成和部署。