Kimi K3相关直播内容
000
画布
|大纲
内容详情
直播临时调整说明
调整原因
- 家庭事务优先级
- 家人生病需入院陪护
- 陪护周期覆盖本周大部分时间
- 原定明日录制节目改直播,无剪辑直接播出符合临时调整的应急安排
- 符合临时调整的应急安排
- 原定明日录制节目改直播,无剪辑直接播出符合临时调整的应急安排
- 陪护周期覆盖本周大部分时间
- 家人生病需入院陪护
- 节目停更/顺延安排
- 固定栏目调整
- 《老范读评》直播顺延,本周暂不更新
- 周五星舰发射解说委托同事发布减少自身内容产出压力
- 减少自身内容产出压力
- 周五星舰发射解说委托同事发布减少自身内容产出压力
- 周五常规直播大概率取消
- 周末前仅可能不定时开临时直播不做固定内容筹备和剪辑
- 不做固定内容筹备和剪辑
- 周末前仅可能不定时开临时直播不做固定内容筹备和剪辑
- 《老范读评》直播顺延,本周暂不更新
- 固定栏目调整
直播前置细节
- 开播时间设定
- 原定等待至晚8点正式开始内容
- 开播前同步临时调整公告
- 回应新观众欢迎互动提升临时直播的观众体验
- 提升临时直播的观众体验
- 回应新观众欢迎互动提升临时直播的观众体验
- 开播前同步临时调整公告
- 原定等待至晚8点正式开始内容
- 个人事务同步
- 车辆正在充电,直播结束后再挪车
- 充电剩余时间支撑后续互动环节
- 延长观众提问答疑的预留时间充分利用充电等待的空档
- 充分利用充电等待的空档
- 延长观众提问答疑的预留时间充分利用充电等待的空档
- 充电剩余时间支撑后续互动环节
- 车辆正在充电,直播结束后再挪车
Kimi K3个人实测体验
订阅踩坑过程
- 套餐门槛限制
- 初始购买49元套餐无法使用Kimi K3
- 需升级99元档位才可解锁基础权限
- 49元充值原路退回符合官方的订阅规则设定
- 符合官方的订阅规则设定
- 49元充值原路退回符合官方的订阅规则设定
- 需升级99元档位才可解锁基础权限
- 99元档位仅支持256K上下文
- 100万TOKEN上下文需开通699元/月档位
- 折合每月约100美元,定价高于海外头部模型与OpenAI、Anthropic定价相比无优势
- 与OpenAI、Anthropic定价相比无优势
- 折合每月约100美元,定价高于海外头部模型与OpenAI、Anthropic定价相比无优势
- 100万TOKEN上下文需开通699元/月档位
- 初始购买49元套餐无法使用Kimi K3
功能实测表现
- 第三方系统适配
- OpenCode等第三方平台调用效果一般
- 简单代码任务完成率低,多次失败
- 第三方适配优化不足生态兼容尚不完善
- 生态兼容尚不完善
- 第三方适配优化不足生态兼容尚不完善
- 简单代码任务完成率低,多次失败
- OpenCode等第三方平台调用效果一般
- 官方工具表现
- Kimi Work、Kimi Code使用效果较好
- 简单小游戏需求一次生成达标
- 迭代修改需求响应顺畅,符合预期官方工具适配更贴合模型能力
- 官方工具适配更贴合模型能力
- 迭代修改需求响应顺畅,符合预期官方工具适配更贴合模型能力
- 简单小游戏需求一次生成达标
- Kimi Work、Kimi Code使用效果较好
核心体验痛点
- 响应速度极慢
- 同复杂度任务耗时远超竞品
- 简单前端任务常需2-3小时完成
- 内部多进程博弈、反复校验拖慢速度时间换质量的策略导致效率低
- 时间换质量的策略导致效率低
- 内部多进程博弈、反复校验拖慢速度时间换质量的策略导致效率低
- 简单前端任务常需2-3小时完成
- 同复杂度任务耗时远超竞品
- 使用成本高昂
- 99元档位仅够基础测试使用
- 高频使用需699元档位起步,额外消耗信用点
- 多轮校验导致TOKEN消耗超竞品数倍总账计算成本高于海外头部模型
- 总账计算成本高于海外头部模型
- 多轮校验导致TOKEN消耗超竞品数倍总账计算成本高于海外头部模型
- 高频使用需699元档位起步,额外消耗信用点
- 99元档位仅够基础测试使用
- 个人使用决策
- 99元套餐到期后不再续订
- 优先选择成本、速度、质量更平衡的闭源模型
- 个人无需极致质量,平衡优先级更高符合普通用户的实际使用需求
- 符合普通用户的实际使用需求
- 个人无需极致质量,平衡优先级更高符合普通用户的实际使用需求
- 优先选择成本、速度、质量更平衡的闭源模型
- 99元套餐到期后不再续订
Kimi K3基础参数与定位
基本属性
- 模型身份
- 史上最大开放权重开源大模型(MoE)
- 参数量2.8万亿(2.8T),比DeepSeek V4高75%
- 混合专家模型(MoE, Mixture of Experts)多专家协作,按需激活部分参数
- 多专家协作,按需激活部分参数
- 混合专家模型(MoE, Mixture of Experts)多专家协作,按需激活部分参数
- 参数量2.8万亿(2.8T),比DeepSeek V4高75%
- 史上最大开放权重开源大模型(MoE)
- 发布信息
- 月之暗面2026年7月16日发布
- 完整权重最晚7月27日开放下载
- 发布节点契合上海世界人工智能大会行业关注度进一步提升
- 行业关注度进一步提升
- 发布节点契合上海世界人工智能大会行业关注度进一步提升
- 完整权重最晚7月27日开放下载
- 月之暗面2026年7月16日发布
- 核心负责人
- 创始人杨植麟,AI领域资深研究者
- 网传曾拒苹果offer回国创业,为导师公开表述
- 团队技术背景支撑大模型研发能力核心团队的技术实力强劲
- 核心团队的技术实力强劲
- 团队技术背景支撑大模型研发能力核心团队的技术实力强劲
- 网传曾拒苹果offer回国创业,为导师公开表述
- 创始人杨植麟,AI领域资深研究者
核心参数
- MoE架构细节
- 共896个专家,单TOKEN仅激活16个
- 平衡模型规模与推理效率
- 按需激活降低单TOKEN计算量缓解大模型推理的算力压力
- 缓解大模型推理的算力压力
- 按需激活降低单TOKEN计算量缓解大模型推理的算力压力
- 平衡模型规模与推理效率
- 共896个专家,单TOKEN仅激活16个
- 上下文能力
- 原生支持100万TOKEN上下文
- 覆盖文、图、视频多模态输入输出
- 非全模态模型,暂不支持音频处理音频能力需对接单独音频模型
- 音频能力需对接单独音频模型
- 非全模态模型,暂不支持音频处理音频能力需对接单独音频模型
- 覆盖文、图、视频多模态输入输出
- 原生支持100万TOKEN上下文
训练相关细节
- 训练平台与硬件
- 大股东阿里提供阿里云算力支撑
- 训练核心采用英伟达H200S芯片
- 部分测试兼容国产GPGPU、英伟达L20多硬件适配降低供应链风险
- 多硬件适配降低供应链风险
- 部分测试兼容国产GPGPU、英伟达L20多硬件适配降低供应链风险
- 训练核心采用英伟达H200S芯片
- 大股东阿里提供阿里云算力支撑
- 训练技术特点
- 原生4比特量化感知训练
- 从微调阶段即采用4比特精度
- 官方称目标为兼容更多部署硬件降低后续落地的硬件门槛
- 降低后续落地的硬件门槛
- 官方称目标为兼容更多部署硬件降低后续落地的硬件门槛
- 从微调阶段即采用4比特精度
- 原生4比特量化感知训练
Kimi K3技术优化细节
核心性能瓶颈
- 算力/内存消耗逻辑
- 长上下文+大参数需高维矩阵乘法
- 计算开销极度依赖HBM高带宽显存
- 普通DDR内存带宽无法满足需求显存成本成为核心制约因素
- 显存成本成为核心制约因素
- 普通DDR内存带宽无法满足需求显存成本成为核心制约因素
- 计算开销极度依赖HBM高带宽显存
- 长上下文+大参数需高维矩阵乘法
- 行业判断
- 彭博社称Kimi K3是内存而非算力故事
- 显存需求增长利好上游存储厂商
- 成为后续股市波动的核心逻辑支撑直接影响相关板块的市场预期
- 直接影响相关板块的市场预期
- 成为后续股市波动的核心逻辑支撑直接影响相关板块的市场预期
- 显存需求增长利好上游存储厂商
- 彭博社称Kimi K3是内存而非算力故事
算法优化方向
- 注意力机制优化
- Kimi Delta Attention(KDA,混合线性注意力)
- 高效线性注意力与全量注意力3:1交错使用
- 长上下文处理效率提升6.3倍降低长文本的计算开销
- 降低长文本的计算开销
- 长上下文处理效率提升6.3倍降低长文本的计算开销
- 高效线性注意力与全量注意力3:1交错使用
- Kimi Delta Attention(KDA,混合线性注意力)
- 训练效率优化
- Attention Residuals注意力残差技术
- 训练效率提升25%,额外成本低于2%
- 从模型深度维度优化训练速度减少大模型训练的时间成本
- 减少大模型训练的时间成本
- 从模型深度维度优化训练速度减少大模型训练的时间成本
- 训练效率提升25%,额外成本低于2%
- Attention Residuals注意力残差技术
- MoE路由优化
- Stable LatentMoE稳定隐空间路由架构
- 分位数均衡分配专家调用任务
- 整体缩放效率比K2提升2.5倍提升大参数模型的扩展性价比
- 提升大参数模型的扩展性价比
- 整体缩放效率比K2提升2.5倍提升大参数模型的扩展性价比
- 分位数均衡分配专家调用任务
- Stable LatentMoE稳定隐空间路由架构
Kimi K3跑分与第三方实测
综合跑分表现
- 第三方评分
- Artificial Analysis综合智能评分57分
- 位列Claude Fable 5、GPT-5.6 Sol之后
- 排在Grok 4.5、智谱GLM-5.2之前,进入第一梯队综合能力达全球头部水平
- 综合能力达全球头部水平
- 排在Grok 4.5、智谱GLM-5.2之前,进入第一梯队综合能力达全球头部水平
- 位列Claude Fable 5、GPT-5.6 Sol之后
- Artificial Analysis综合智能评分57分
- 优势赛道
- 长链路任务跑分全球第一
- 覆盖SWE马拉松编程、前端编码竞技、浏览任务、自动化任务、文档解析
- SWE马拉松得分42分,超Opus 4.8(40分)、GPT-5.6(39分)长任务推理能力领先头部竞品
- 长任务推理能力领先头部竞品
- SWE马拉松得分42分,超Opus 4.8(40分)、GPT-5.6(39分)长任务推理能力领先头部竞品
- 覆盖SWE马拉松编程、前端编码竞技、浏览任务、自动化任务、文档解析
- 长链路任务跑分全球第一
- 短板赛道
- 硬核推理与旗舰编程榜落后
- DeepSWE编程榜67.5分,低于GPT-5.6 Sol的73分
- HLE硬核推理得分比Fable 5低10分无断层领先优势,存在明显短板
- 无断层领先优势,存在明显短板
- HLE硬核推理得分比Fable 5低10分无断层领先优势,存在明显短板
- DeepSWE编程榜67.5分,低于GPT-5.6 Sol的73分
- 硬核推理与旗舰编程榜落后
第三方横向对比测试
- 多模型同任务测试
- 3D渲染图转HTML交互页任务
- GPT-5.6 Sol耗时10-20分钟,结果粗糙
- Claude Fable 5耗时40分钟,质量、速度居中平衡型产品适配更多普通场景
- 平衡型产品适配更多普通场景
- Claude Fable 5耗时40分钟,质量、速度居中平衡型产品适配更多普通场景
- Kimi K3耗时2-3小时,还原度与效果最优
- 内部多轮讨论验证,TOKEN消耗超竞品数倍以时间和成本换质量的路线明确
- 以时间和成本换质量的路线明确
- 内部多轮讨论验证,TOKEN消耗超竞品数倍以时间和成本换质量的路线明确
- GPT-5.6 Sol耗时10-20分钟,结果粗糙
- 3D渲染图转HTML交互页任务
- 成本核算逻辑
- 官方单TOKEN报价低于竞品
- 国内API缓存命中百万TOKEN 2元,未命中20元,输出百万TOKEN 100元
- 内部多轮校验导致总消耗是竞品10倍以上同任务总账成本反而高于海外模型
- 同任务总账成本反而高于海外模型
- 内部多轮校验导致总消耗是竞品10倍以上同任务总账成本反而高于海外模型
- 国内API缓存命中百万TOKEN 2元,未命中20元,输出百万TOKEN 100元
- 成本相对价值可忽略
- TOKEN成本远低于人力解决同问题的成本
- 专业用户对价格敏感度较低企业级用户更关注结果质量
- 企业级用户更关注结果质量
- 专业用户对价格敏感度较低企业级用户更关注结果质量
- TOKEN成本远低于人力解决同问题的成本
- 官方单TOKEN报价低于竞品
相关市场波动分析
海外市场波动
- 短期下跌情况
- 2026年7月17日海外股市普跌
- 纳斯达克跌1.4%,标普跌1.01%,道指跌0.77%
- 英伟达跌2.2%,应用材料跌5.6%,SK海力士盘中跌11%触发熔断市场短期恐慌情绪蔓延
- 市场短期恐慌情绪蔓延
- 英伟达跌2.2%,应用材料跌5.6%,SK海力士盘中跌11%触发熔断市场短期恐慌情绪蔓延
- 纳斯达克跌1.4%,标普跌1.01%,道指跌0.77%
- 2026年7月17日海外股市普跌
- 波动原因拆解
- Kimi K3仅为导火索,非核心原因
- 下跌预期早已存在,叠加内存涨价、美股财报周不确定性
- 短期下跌后AI相关个股快速反弹无长期趋势性下跌逻辑
- 无长期趋势性下跌逻辑
- 短期下跌后AI相关个股快速反弹无长期趋势性下跌逻辑
- 下跌预期早已存在,叠加内存涨价、美股财报周不确定性
- Kimi K3仅为导火索,非核心原因
- 中长期逻辑
- 大模型扩容利好上游芯片、存储厂商
- 显存、算力需求长期增长,供给集中在英伟达、三星等厂商
- 长期需求逻辑反而被Kimi K3加固上游厂商受益于大模型参数竞赛
- 上游厂商受益于大模型参数竞赛
- 长期需求逻辑反而被Kimi K3加固上游厂商受益于大模型参数竞赛
- 显存、算力需求长期增长,供给集中在英伟达、三星等厂商
- 大模型扩容利好上游芯片、存储厂商
国内市场波动
- 国内AI股下跌情况
- 智谱、MiniMax股价大幅下跌
- 智谱7月17日单日跌28.49%,两个交易日跌近4成
- 市值蒸发超千亿港币市场恐慌情绪被放大
- 市场恐慌情绪被放大
- 市值蒸发超千亿港币市场恐慌情绪被放大
- 智谱7月17日单日跌28.49%,两个交易日跌近4成
- 智谱、MiniMax股价大幅下跌
- 核心原因拆解
- 核心为解禁与增发导致供给双杀
- 智谱流通股从3.9%升至9.7%,叠加增发扩大供给
- 全球AI板块集体抛售、流动性收紧为外部因素与Kimi K3无直接因果关系
- 与Kimi K3无直接因果关系
- 全球AI板块集体抛售、流动性收紧为外部因素与Kimi K3无直接因果关系
- 智谱流通股从3.9%升至9.7%,叠加增发扩大供给
- Kimi K3仅为火上浇油
- 与智谱GLM-5.2定位高度重合,编码能力更优
- 市场担忧智谱客户留存与收入能力放大了市场的悲观预期
- 放大了市场的悲观预期
- 市场担忧智谱客户留存与收入能力放大了市场的悲观预期
- 与智谱GLM-5.2定位高度重合,编码能力更优
- 核心为解禁与增发导致供给双杀
行业反馈与后续趋势
海外行业反馈
- 头部企业反应
- Anthropic CEO达里奥·阿莫迪表示超出预期
- 原判断中国模型追平美国需半年,K3提前打破预期
- 公开表达对中国AI进展的意外全球AI竞争节奏被打乱
- 全球AI竞争节奏被打乱
- 公开表达对中国AI进展的意外全球AI竞争节奏被打乱
- 原判断中国模型追平美国需半年,K3提前打破预期
- 马斯克两次点赞月之暗面技术
- 原预测中国模型追平需2027年一季度
- 宣布自家2万亿参数新模型即将完成初始训练被怼未开源,未正面回应
- 被怼未开源,未正面回应
- 宣布自家2万亿参数新模型即将完成初始训练被怼未开源,未正面回应
- 原预测中国模型追平需2027年一季度
- Anthropic CEO达里奥·阿莫迪表示超出预期
- 其他传闻
- 微软考虑用Kimi K3替换Copilot中GPT/Claude
- 传闻年省6亿美金,需承担美国政策风险
- 消息来源可信度低,未被证实仅为市场传闻无实据
- 仅为市场传闻无实据
- 消息来源可信度低,未被证实仅为市场传闻无实据
- 传闻年省6亿美金,需承担美国政策风险
- 美国拟收紧中国开源AI限制
- Axios报道特朗普政府正推动相关行政令
- 开放权重模型可下载部署,禁令执行难度极大实际限制效果存疑
- 实际限制效果存疑
- 开放权重模型可下载部署,禁令执行难度极大实际限制效果存疑
- Axios报道特朗普政府正推动相关行政令
- 微软考虑用Kimi K3替换Copilot中GPT/Claude
大模型行业趋势
- 参数竞赛全面升级
- 2T以上参数成为行业新赛道
- 通义千问Qwen3.8-Max(2.4T)已上线
- 马斯克2T参数模型即将完成训练头部厂商全面跟进大参数路线
- 头部厂商全面跟进大参数路线
- 马斯克2T参数模型即将完成训练头部厂商全面跟进大参数路线
- 通义千问Qwen3.8-Max(2.4T)已上线
- 竞品发布节奏调整
- 谷歌Gemini 3.5 Pro多次推迟发布
- 智谱取消5.3版本,直接研发2T以上的5.5版本MiniMax M3 Pro(2T+)正在研发美团LongCat、小米MiMo等大模型稳步推进
- MiniMax M3 Pro(2T+)正在研发
- 美团LongCat、小米MiMo等大模型稳步推进
- 智谱取消5.3版本,直接研发2T以上的5.5版本MiniMax M3 Pro(2T+)正在研发美团LongCat、小米MiMo等大模型稳步推进
- 谷歌Gemini 3.5 Pro多次推迟发布
- 2T以上参数成为行业新赛道
- 供应链与算力情况
- 中国大模型厂商算力储备充足
- 大量算力部署在新加坡、马来西亚、中东等地
- 国产芯片可支撑推理需求,训练仍以英伟达芯片为主美国制裁实际影响有限
- 美国制裁实际影响有限
- 国产芯片可支撑推理需求,训练仍以英伟达芯片为主美国制裁实际影响有限
- 大量算力部署在新加坡、马来西亚、中东等地
- 中国大模型厂商算力储备充足
行业意义与结论
核心行业价值
- 发展路径明确
- 指明“堆料换质量”的可行路线
- 扩大参数、拉长思考链路、多轮验证可提升输出质量
- TOKEN成本相对产出价值可忽略不计打破行业对成本的过度顾虑
- 打破行业对成本的过度顾虑
- TOKEN成本相对产出价值可忽略不计打破行业对成本的过度顾虑
- 扩大参数、拉长思考链路、多轮验证可提升输出质量
- 指明“堆料换质量”的可行路线
- 开源贡献
- 开门干活为全行业指明方向
- 技术论文全部公开,全行业可复用优化成果
- 与OpenAI、Anthropic闭源模式形成互补推动全行业技术快速迭代
- 推动全行业技术快速迭代
- 与OpenAI、Anthropic闭源模式形成互补推动全行业技术快速迭代
- 技术论文全部公开,全行业可复用优化成果
- 开门干活为全行业指明方向
- 主权AI落地支撑
- 提供“听话且足够聪明”的选择
- 开源可本地化部署,自主可控性强
- 能力追平海外闭源头部模型解决主权AI“忠诚”与“能力”的取舍矛盾
- 解决主权AI“忠诚”与“能力”的取舍矛盾
- 能力追平海外闭源头部模型解决主权AI“忠诚”与“能力”的取舍矛盾
- 带动算力、显存需求长期增长
- 利好上游芯片、存储厂商重构全球AI供应链需求结构
- 重构全球AI供应链需求结构
- 利好上游芯片、存储厂商重构全球AI供应链需求结构
- 开源可本地化部署,自主可控性强
- 提供“听话且足够聪明”的选择
最终结论
- Kimi K3属于DeepSeek级别的里程碑时刻
- 与DeepSeek一样为行业指明新方向,打破原有竞争节奏
- 带动全行业进入参数竞赛新阶段,引发市场连锁反应具备独立的行业里程碑意义 :::label ["Kimi K3大模型", "AI行业分析", "开源大模型"] :::
- 具备独立的行业里程碑意义 :::label ["Kimi K3大模型", "AI行业分析", "开源大模型"] :::
- 带动全行业进入参数竞赛新阶段,引发市场连锁反应具备独立的行业里程碑意义 :::label ["Kimi K3大模型", "AI行业分析", "开源大模型"] :::
- 与DeepSeek一样为行业指明新方向,打破原有竞争节奏
