“参数越大,能力上限越高,能够给大家提供更智能的模型表现。”有关负责这个的人说,参数就像人脑里的神经连接,近3万亿参数意味着这一个模型能把更多的知识和规律装进“脑子”,懂得更多、想得更深、答得更准。
当前,人工智能技术加速迭代,正迎来爆发式发展。前沿人工智能的发展,正在慢慢地转向算法创新、工程组织、应用能力和资源效率的综合运用。
据了解,在评测中,KimiK3综合智能水平接近全球前沿的闭源模型。有关负责的人介绍,在训练KimiK3新一代基座大模型的过程中,其使用了自主研发的底层模型架构,并积累形成了一整套科学的模型训练方法。
近年来,中国格外的重视人工智能发展,推动人工智能总实力整体性、系统性跃升,并同世界共享发展经验和技术产品。
北京中关村学院院长刘铁岩表示,技术的生命力在于开放流动,一批中国开源大模型从“单点亮相”走向“群体突破”,为世界人工智能发展提供了新方案、新路径,将加快推进人工智能技术向上向善发展。
过去一年,全球大模型竞争逐步从单一榜单成绩转向预训练规模、架构效率、复杂任务能力和工程可用性的综合较量。K3的研发重点不是简单扩大参数规模,而是通过模型架构、训练方法等协同优化,将规模优势进一步转化为能力提升。
在评测中,KimiK3展现出全球领先的综合能力。在参与测试的模型中,KimiK3综合智能水平仅次于ClaudeFable5和GPT-5.6Sol两个前沿闭源模型,并在编程、视觉理解、知识工作和长程任务处理等方面表现突出。
特别在软件工程场景中,KimiK3能够结合源代码、渲染结果、运行日志和测试反馈判断下一步修改方向,适用于前端工程、游戏开发、基础设施优化、科研编程等任务。
通过模型结构、训练方法和数据配方等方面的优化,KimiK3相较上一代模型整体扩展效率提升约2.5倍,有助于进一步提升算力向模型能力转化的效率。
从应用能力看,KimiK3不仅仅可以完成明确的代码生成和修改任务,还可进一步参与开放式创作和复杂知识生产。
在数字作品生成场景中,该模型可结合3D推理、编程和视觉能力,将概念、图片或视频转化为交互体验;
在金融研究、产业分析等场景中,可对公司文件、行业数据和长期产业资料做组织分析,生成可读、可查、可验证的深度报告。
月之暗面表示,该模型完整权重即将发布,模型架构、训练和评测细节将随模型技术报告陆续公布。
1、凡本网注明“来源:荆州新闻网、荆州广播电视台”的全部作品,版权均属于荆州新闻网,未经本网授权不得转载、摘编或利用其它方式使用上述作品。
2、已经本网授权使用作品的,应在授权范围内使用,并标注明确来源:荆州新闻网。违反上述声明者,本网将追究其有关规定法律责任。