Kimi K3相关直播内容

AAI脑图#3620902026-07-24 08:09
000

内容详情

直播临时调整说明

调整原因

  • 家庭事务优先级
    • 家人生病需入院陪护
      • 陪护周期覆盖本周大部分时间
        • 原定明日录制节目改直播,无剪辑直接播出符合临时调整的应急安排
          • 符合临时调整的应急安排
  • 节目停更/顺延安排
    • 固定栏目调整
      • 《老范读评》直播顺延,本周暂不更新
        • 周五星舰发射解说委托同事发布减少自身内容产出压力
          • 减少自身内容产出压力
      • 周五常规直播大概率取消
        • 周末前仅可能不定时开临时直播不做固定内容筹备和剪辑
          • 不做固定内容筹备和剪辑

直播前置细节

  • 开播时间设定
    • 原定等待至晚8点正式开始内容
      • 开播前同步临时调整公告
        • 回应新观众欢迎互动提升临时直播的观众体验
          • 提升临时直播的观众体验
  • 个人事务同步
    • 车辆正在充电,直播结束后再挪车
      • 充电剩余时间支撑后续互动环节
        • 延长观众提问答疑的预留时间充分利用充电等待的空档
          • 充分利用充电等待的空档

Kimi K3个人实测体验

订阅踩坑过程

  • 套餐门槛限制
    • 初始购买49元套餐无法使用Kimi K3
      • 需升级99元档位才可解锁基础权限
        • 49元充值原路退回符合官方的订阅规则设定
          • 符合官方的订阅规则设定
    • 99元档位仅支持256K上下文
      • 100万TOKEN上下文需开通699元/月档位
        • 折合每月约100美元,定价高于海外头部模型与OpenAI、Anthropic定价相比无优势
          • 与OpenAI、Anthropic定价相比无优势

功能实测表现

  • 第三方系统适配
    • OpenCode等第三方平台调用效果一般
      • 简单代码任务完成率低,多次失败
        • 第三方适配优化不足生态兼容尚不完善
          • 生态兼容尚不完善
  • 官方工具表现
    • Kimi Work、Kimi Code使用效果较好
      • 简单小游戏需求一次生成达标
        • 迭代修改需求响应顺畅,符合预期官方工具适配更贴合模型能力
          • 官方工具适配更贴合模型能力

核心体验痛点

  • 响应速度极慢
    • 同复杂度任务耗时远超竞品
      • 简单前端任务常需2-3小时完成
        • 内部多进程博弈、反复校验拖慢速度时间换质量的策略导致效率低
          • 时间换质量的策略导致效率低
  • 使用成本高昂
    • 99元档位仅够基础测试使用
      • 高频使用需699元档位起步,额外消耗信用点
        • 多轮校验导致TOKEN消耗超竞品数倍总账计算成本高于海外头部模型
          • 总账计算成本高于海外头部模型
  • 个人使用决策
    • 99元套餐到期后不再续订
      • 优先选择成本、速度、质量更平衡的闭源模型
        • 个人无需极致质量,平衡优先级更高符合普通用户的实际使用需求
          • 符合普通用户的实际使用需求

Kimi K3基础参数与定位

基本属性

  • 模型身份
    • 史上最大开放权重开源大模型(MoE)
      • 参数量2.8万亿(2.8T),比DeepSeek V4高75%
        • 混合专家模型(MoE, Mixture of Experts)多专家协作,按需激活部分参数
          • 多专家协作,按需激活部分参数
  • 发布信息
    • 月之暗面2026年7月16日发布
      • 完整权重最晚7月27日开放下载
        • 发布节点契合上海世界人工智能大会行业关注度进一步提升
          • 行业关注度进一步提升
  • 核心负责人
    • 创始人杨植麟,AI领域资深研究者
      • 网传曾拒苹果offer回国创业,为导师公开表述
        • 团队技术背景支撑大模型研发能力核心团队的技术实力强劲
          • 核心团队的技术实力强劲

核心参数

  • MoE架构细节
    • 共896个专家,单TOKEN仅激活16个
      • 平衡模型规模与推理效率
        • 按需激活降低单TOKEN计算量缓解大模型推理的算力压力
          • 缓解大模型推理的算力压力
  • 上下文能力
    • 原生支持100万TOKEN上下文
      • 覆盖文、图、视频多模态输入输出
        • 非全模态模型,暂不支持音频处理音频能力需对接单独音频模型
          • 音频能力需对接单独音频模型

训练相关细节

  • 训练平台与硬件
    • 大股东阿里提供阿里云算力支撑
      • 训练核心采用英伟达H200S芯片
        • 部分测试兼容国产GPGPU、英伟达L20多硬件适配降低供应链风险
          • 多硬件适配降低供应链风险
  • 训练技术特点
    • 原生4比特量化感知训练
      • 从微调阶段即采用4比特精度
        • 官方称目标为兼容更多部署硬件降低后续落地的硬件门槛
          • 降低后续落地的硬件门槛

Kimi K3技术优化细节

核心性能瓶颈

  • 算力/内存消耗逻辑
    • 长上下文+大参数需高维矩阵乘法
      • 计算开销极度依赖HBM高带宽显存
        • 普通DDR内存带宽无法满足需求显存成本成为核心制约因素
          • 显存成本成为核心制约因素
  • 行业判断
    • 彭博社称Kimi K3是内存而非算力故事
      • 显存需求增长利好上游存储厂商
        • 成为后续股市波动的核心逻辑支撑直接影响相关板块的市场预期
          • 直接影响相关板块的市场预期

算法优化方向

  • 注意力机制优化
    • Kimi Delta Attention(KDA,混合线性注意力)
      • 高效线性注意力与全量注意力3:1交错使用
        • 长上下文处理效率提升6.3倍降低长文本的计算开销
          • 降低长文本的计算开销
  • 训练效率优化
    • Attention Residuals注意力残差技术
      • 训练效率提升25%,额外成本低于2%
        • 从模型深度维度优化训练速度减少大模型训练的时间成本
          • 减少大模型训练的时间成本
  • MoE路由优化
    • Stable LatentMoE稳定隐空间路由架构
      • 分位数均衡分配专家调用任务
        • 整体缩放效率比K2提升2.5倍提升大参数模型的扩展性价比
          • 提升大参数模型的扩展性价比

Kimi K3跑分与第三方实测

综合跑分表现

  • 第三方评分
    • Artificial Analysis综合智能评分57分
      • 位列Claude Fable 5、GPT-5.6 Sol之后
        • 排在Grok 4.5、智谱GLM-5.2之前,进入第一梯队综合能力达全球头部水平
          • 综合能力达全球头部水平
  • 优势赛道
    • 长链路任务跑分全球第一
      • 覆盖SWE马拉松编程、前端编码竞技、浏览任务、自动化任务、文档解析
        • SWE马拉松得分42分,超Opus 4.8(40分)、GPT-5.6(39分)长任务推理能力领先头部竞品
          • 长任务推理能力领先头部竞品
  • 短板赛道
    • 硬核推理与旗舰编程榜落后
      • DeepSWE编程榜67.5分,低于GPT-5.6 Sol的73分
        • HLE硬核推理得分比Fable 5低10分无断层领先优势,存在明显短板
          • 无断层领先优势,存在明显短板

第三方横向对比测试

  • 多模型同任务测试
    • 3D渲染图转HTML交互页任务
      • GPT-5.6 Sol耗时10-20分钟,结果粗糙
        • Claude Fable 5耗时40分钟,质量、速度居中平衡型产品适配更多普通场景
          • 平衡型产品适配更多普通场景
      • Kimi K3耗时2-3小时,还原度与效果最优
        • 内部多轮讨论验证,TOKEN消耗超竞品数倍以时间和成本换质量的路线明确
          • 以时间和成本换质量的路线明确
  • 成本核算逻辑
    • 官方单TOKEN报价低于竞品
      • 国内API缓存命中百万TOKEN 2元,未命中20元,输出百万TOKEN 100元
        • 内部多轮校验导致总消耗是竞品10倍以上同任务总账成本反而高于海外模型
          • 同任务总账成本反而高于海外模型
    • 成本相对价值可忽略
      • TOKEN成本远低于人力解决同问题的成本
        • 专业用户对价格敏感度较低企业级用户更关注结果质量
          • 企业级用户更关注结果质量

相关市场波动分析

海外市场波动

  • 短期下跌情况
    • 2026年7月17日海外股市普跌
      • 纳斯达克跌1.4%,标普跌1.01%,道指跌0.77%
        • 英伟达跌2.2%,应用材料跌5.6%,SK海力士盘中跌11%触发熔断市场短期恐慌情绪蔓延
          • 市场短期恐慌情绪蔓延
  • 波动原因拆解
    • Kimi K3仅为导火索,非核心原因
      • 下跌预期早已存在,叠加内存涨价、美股财报周不确定性
        • 短期下跌后AI相关个股快速反弹无长期趋势性下跌逻辑
          • 无长期趋势性下跌逻辑
  • 中长期逻辑
    • 大模型扩容利好上游芯片、存储厂商
      • 显存、算力需求长期增长,供给集中在英伟达、三星等厂商
        • 长期需求逻辑反而被Kimi K3加固上游厂商受益于大模型参数竞赛
          • 上游厂商受益于大模型参数竞赛

国内市场波动

  • 国内AI股下跌情况
    • 智谱、MiniMax股价大幅下跌
      • 智谱7月17日单日跌28.49%,两个交易日跌近4成
        • 市值蒸发超千亿港币市场恐慌情绪被放大
          • 市场恐慌情绪被放大
  • 核心原因拆解
    • 核心为解禁与增发导致供给双杀
      • 智谱流通股从3.9%升至9.7%,叠加增发扩大供给
        • 全球AI板块集体抛售、流动性收紧为外部因素与Kimi K3无直接因果关系
          • 与Kimi K3无直接因果关系
    • Kimi K3仅为火上浇油
      • 与智谱GLM-5.2定位高度重合,编码能力更优
        • 市场担忧智谱客户留存与收入能力放大了市场的悲观预期
          • 放大了市场的悲观预期

行业反馈与后续趋势

海外行业反馈

  • 头部企业反应
    • Anthropic CEO达里奥·阿莫迪表示超出预期
      • 原判断中国模型追平美国需半年,K3提前打破预期
        • 公开表达对中国AI进展的意外全球AI竞争节奏被打乱
          • 全球AI竞争节奏被打乱
    • 马斯克两次点赞月之暗面技术
      • 原预测中国模型追平需2027年一季度
        • 宣布自家2万亿参数新模型即将完成初始训练被怼未开源,未正面回应
          • 被怼未开源,未正面回应
  • 其他传闻
    • 微软考虑用Kimi K3替换Copilot中GPT/Claude
      • 传闻年省6亿美金,需承担美国政策风险
        • 消息来源可信度低,未被证实仅为市场传闻无实据
          • 仅为市场传闻无实据
    • 美国拟收紧中国开源AI限制
      • Axios报道特朗普政府正推动相关行政令
        • 开放权重模型可下载部署,禁令执行难度极大实际限制效果存疑
          • 实际限制效果存疑

大模型行业趋势

  • 参数竞赛全面升级
    • 2T以上参数成为行业新赛道
      • 通义千问Qwen3.8-Max(2.4T)已上线
        • 马斯克2T参数模型即将完成训练头部厂商全面跟进大参数路线
          • 头部厂商全面跟进大参数路线
    • 竞品发布节奏调整
      • 谷歌Gemini 3.5 Pro多次推迟发布
        • 智谱取消5.3版本,直接研发2T以上的5.5版本MiniMax M3 Pro(2T+)正在研发美团LongCat、小米MiMo等大模型稳步推进
          • MiniMax M3 Pro(2T+)正在研发
          • 美团LongCat、小米MiMo等大模型稳步推进
  • 供应链与算力情况
    • 中国大模型厂商算力储备充足
      • 大量算力部署在新加坡、马来西亚、中东等地
        • 国产芯片可支撑推理需求,训练仍以英伟达芯片为主美国制裁实际影响有限
          • 美国制裁实际影响有限

行业意义与结论

核心行业价值

  • 发展路径明确
    • 指明“堆料换质量”的可行路线
      • 扩大参数、拉长思考链路、多轮验证可提升输出质量
        • TOKEN成本相对产出价值可忽略不计打破行业对成本的过度顾虑
          • 打破行业对成本的过度顾虑
  • 开源贡献
    • 开门干活为全行业指明方向
      • 技术论文全部公开,全行业可复用优化成果
        • 与OpenAI、Anthropic闭源模式形成互补推动全行业技术快速迭代
          • 推动全行业技术快速迭代
  • 主权AI落地支撑
    • 提供“听话且足够聪明”的选择
      • 开源可本地化部署,自主可控性强
        • 能力追平海外闭源头部模型解决主权AI“忠诚”与“能力”的取舍矛盾
          • 解决主权AI“忠诚”与“能力”的取舍矛盾
      • 带动算力、显存需求长期增长
        • 利好上游芯片、存储厂商重构全球AI供应链需求结构
          • 重构全球AI供应链需求结构

最终结论

  • Kimi K3属于DeepSeek级别的里程碑时刻
    • 与DeepSeek一样为行业指明新方向,打破原有竞争节奏
      • 带动全行业进入参数竞赛新阶段,引发市场连锁反应具备独立的行业里程碑意义 :::label ["Kimi K3大模型", "AI行业分析", "开源大模型"] :::
        • 具备独立的行业里程碑意义 :::label ["Kimi K3大模型", "AI行业分析", "开源大模型"] :::