国内大模型创企“月之暗面”发布Kimi模型重磅升级:扩容200万字上下文窗口,新增「继续」延长回复按钮
国内人工智能大模型创业公司“月之暗面”终于有了一次面向媒体的公开活动。虽然CEO杨植麟本人并未露面,但是发布了更长上下文窗口的版本:200万字上下文版本,即日起可在Kimi Chat上开启内测。
并且在与Kimi对话过程中,加入了(不打断模型思路的)「继续」功能按钮。
月之暗面工程副总裁许欣然将几摞打印出来的《中医中医内科学》《中医诊断学》、英伟达2023年年度财报、《甄嬛传》剧本版放在桌面上,一摞比一摞厚。
这是为了用来检验大模型的Tokens上下文窗口吞吐能力。
2023年10月,“月之暗面”团队的产品第一次公开亮相,发布了支持20万字上下文窗口的Kimi大模型。
五个月过去后,Kimi主要在3个方面有所提升:
遵循更复杂的指令更强的信息检索能力推出Chat机器人的网页版、Android客户端、iOS客户端、小程序提出“Kimi 10分钟速成定律”
此次月之暗面最主要的动作,就是将自家模型的上下文窗口提升了一个数量级。即从发布之初的20万字,拓展到200万字。
同时据许欣然透露,5个月过去,相同成本、相同设备情况下,模型响应速度提升了3倍左右。
为了达到更好的长窗口无损压缩性能,月之暗面的研发和技术团队从模型预训练到对齐、推理环节均进行了原生的重新设计和开发,不走“滑动窗口”、“降采样”等技术捷径,攻克了很多底层技术难点。
200万字上下文窗口,意味着Kimi模型能够吃下更长的文档内容,完成更长和更复杂的任务。
包括但不限于,让大模型快速整理N多的文件,例如从500份招聘简历中提取信息:
现场月之暗面还提出了“Kimi 10分钟速成定律”。
即无关领域大众小众,也无关资料或多或少,只要把资料一股脑丢给模型,10分钟内,Kimi都能快速入门一个新领域。
比如德州扑克、中医内科、驾驶飞机、大模型推理……
现场还演示了Kimi模型挖掘长篇故事情节中深层次信息的能力。
案例自然是被人类开发程度不足10%的《甄嬛传》。
值得注意的是,月之暗面在媒体沟通会现场提出了一个新说法,即大模型们最近的新竞速赛道,“大海捞针”功能,恐怕全绿也没什么太大意义了。
最初,大海捞针其实是一个非常好的评测标准,因为当时大家都没有针对这个case去优化过。
但现在它已经不是一个很好的评测指标了,当大家都去关注它的时候,就一定会想尽办法去优化它,慢慢就失去了原本的参考意义。
如果大海捞针不行了,有什么新的评测标准能够检测模型长文本能力吗?
“暂时还没有。”许欣然笑道。
他表示,模型窗口越来越长,评测的纬度变得非常非常多,不过团队已经在和学术界团队共同探讨这个开放性的问题。
期望打造“个人专家助理”
从20万字上下文窗口,迭代为今天开始内测的200万字上下文窗口,具体的模型应用场景又有什么新的亮眼之处?会不会只是从“处理50封简历”到“处理500封简历”的简单线性外扩?
一味拓展大模型上下文窗口的边界,会不会打造出一把普通人想象中的“皇帝的金锄头”?
“实际上,可能会不断地出现更多的现实场景,只有足够长的context才能完成。”
月之暗面表示,在200万字版本推出后,接下来Kimi模型会在以下几个方向发展:
第一、领域专家。
利用长文本能力吃掉一个领域里几乎所有的相关资料,使调研一个行业成为简单的事情。
第二、可完成复杂多步任务的Agent,月之暗面内部称之为“个人麦肯锡”。
希望模型未来不只是像能处理“帮我翻译一下这个PDF”这类非常具体的任务,也能自动完成抽象、复杂的任务。
第三、多模态能力。
Context长了之后,Kimi模型可以容纳更多高清的、时间更长的这种视频,从而让我们模型很方便地去拓展到更多的模态。
据月之暗面联合创始人周昕宇现场的答复,Sora出来以前,月之暗面就在根据自己的节奏推进多模态能力的研发,Sora的出现也并没有打乱原有的安排。
“预计今年会推出我们自己的多模态模型产品。”
One More Thing
最后,他们家的大模型还悄么声地改名了:
Kimi Chat➡️Kimi智能助手;Moonshot大模型➡️Kimi大模型
-
国内大模型创企“月之暗面”发布Kimi模型重磅升级:扩容200万字上下文窗口,新增「继续」延长回复按钮
国内人工智能大模型创业公司“月之暗面”终于有了一次面向媒体的公开活动。发布了更长上下文窗口的版本:200万字上下文版本,即日起可在Kimi Chat上开启内测。
2025-02-06 17:17:20 -
阿里“通义听悟”升级:支持6小时超长视频内容解析提问,还可一键生成巨幅思维导图
阿里通义大模型应用产品“通义听悟”发布多项新功能,上线音视频问答助手“小悟”、一键 AI 改写、思维导图生成等六大功能。
2025-02-06 16:53:33 -
“宝藏AI神器”阿里通义听悟最新更新丨支持超长音视频问答,高校师生可获500小时免费时长
通义听悟最新更新啦,能对所有音视频内容进行全面“解剖”,播客、会议、学习、访谈各种视频均可对其多语言自由提问。不仅可以针对单一记录向它提问,最长6小时、6G大小,还可以跨记录、让“小悟”扫描上百个音视频一起总结回答问题,目前“小悟”支持内容问答的音视频时长和文件数都是业界上限。
2025-02-06 16:25:55 -
奥特曼认为GPT-4“有点糟糕”丨Stability AI推出3D渲染视频模型Stable Video 3D丨谷歌推出多模态视频模型VLOGGER
【AI奇点网2024年3月20日早报】本站每日播报AI业界最新资讯,触摸时代脉搏,掌握未来科技动向。事不宜迟,点击查看今日AI资讯早餐。
2025-02-06 15:57:42 -
谷歌发布首个多模态视频生成模型VLOGGER AI:让静态人物肖像图像开口“说话”
近日,谷歌一款名为 VLOGGER AI 的新模型上线,用户只需要输入一张肖像照片和一段音频内容,该模型可以让这些人物“动起来”,富有面部表情地朗读音频内容。
2025-02-06 15:34:37 -
库克今年首次访华,国内首谈生成式AI丨微软收购OpenAI竞争对手Inflection AI丨黄仁勋回应中国算力芯片出货问题
【AI奇点网2024年3月21日早报】本站每日播报AI业界最新资讯,触摸时代脉搏,掌握未来科技动向。事不宜迟,点击查看今日AI资讯早餐。
2025-02-06 15:08:16
-
商汤AI视频生成器如影使用方法_如影使用教程_AI视频生成测评
国内知名人工智能软件公司商汤科技近日宣布,“商汤如影SenseAvatar”数字人视频生成平台正式上线,产品愿景是“让每个人都可以轻松制作视频”,非常的直抒胸臆呀。
2024-12-17 03:24:28 -
怎么快速给模特换装_怎么用stable diffusion给模特换装
本篇教程主要运用StableDiffusion这个工具来进行操作,下面会通过几个小案例,给大家展示不同需求下,我们该如何使用StableDiffusion来辅助我们完成服装效果展示。本教程适用于电商设计场景、摄影场景等多个运用人物设计的实战中
2024-12-23 13:57:15 -
万万没想到,兵马俑都开始跳「科目三」:阿里云通义千问APP打造“全民舞王”视频创作工具,实测效果大赞
兵马俑跳《科目三》,是我万万没想到的。有人借助了阿里云之前走红的AI视频生成技术——「Animate Anyone」,生成出来了这个舞蹈片段。
2024-12-13 16:46:26 -
AIGC落地实践!四招帮你快速搞定运营设计
回顾这一年,随着 AIGC 浪潮的爆发,在掌握AI工具已经成为设计师必备技能。今天这篇文章,通过三个案例流程拆解带大家从新时代设计工作流,到必备「四大招式」,到图标设计六大方向,到训练专属模型,再到全流程手把手拆解设计项目,绝对干货满满
2024-12-18 16:57:17 -
stable diffusion初识_stable diffusion跟其他工具有什么区别]
关于Stable Diffusion的内容很多,在本篇教程里,我会先为你介绍Stable Diffusion模型的运行原理、发展历程和相较于其他AI绘图应用的区别。
2024-12-24 13:45:31 -
如何使用 ChatGPT 调试代码
当您的代码出现问题时,您可以向 ChatGPT 提供故障代码和问题描述。AI 工具将尝试识别并纠正问题。
2024-12-31 12:01:41 -
stable SR脚本安装_stable diffusion脚本网站
上节课我们讲的4xUltraSharp是不是觉得已经很强了! 那么如果我拿出Stable SR脚本你应该如何应对呢?
2024-12-31 13:49:18 -
怎么设置关键词权重_怎么设置Multi Prompts
AI 绘画,顾名思义就是利用人工智能进行绘画,是人工智能生成内容(AIGC)的一个应用场景。其主要原理简单来说就是收集大量已有作品数据,通过算法对它们进行解析,最后再生成新作品,Midjourney是一个由同名研究实验室开发的人工智能程序。
2025-01-03 10:00:57 -
零基础2天速成!白嫖「秋叶」官方AI绘画课程,卷死同事
和「秋叶」一起学AI绘画,掌握Stable Diffusion、Midjourney的使用方法,开展AI绘画副业,搞钱!?
2024-12-17 12:53:01 -
思维脑图工具也能创作AI绘画作品,如何使用博思白板进行AI绘画
博思白板boardmix的创作平台提供多种登录方式,最方便要属直接微信扫码登录,然后绑定手机号实名制。再点击页面正中央紫色的按钮「免费使用」,你就可以进入博思白板boardmix的内容创作操作台。
2024-12-26 09:08:34