行业资讯
【AI】技术日报 · 2026-07-18
AI 技术日报 · 2026-07-18 聚焦国内大厂大模型与前沿技术关键词Kimi K3、WAIC 2026、腾讯混元 Hy3、通义千问、DeepSeek V4、昇腾 950本文由每日 AI 资讯自动整理内容来自公开报道参数与发布时间以各厂商官方公告为准。摘要本周国内 AI 圈的核心事件高度集中2026 世界人工智能大会WAIC于 7 月 17 日在上海开幕超 300 款产品全球首发就在开幕前一天月之暗面Moonshot AI甩出重磅炸弹——全球最大的开源大模型 Kimi K32.8 万亿参数。与此同时腾讯混元 Hy3 转向开源、阿里通义千问密集升级、DeepSeek 公开 V4 完整技术报告、华为昇腾 950 超节点真机首秀。本文挑选其中最具技术含量的几条做一次系统梳理。本期目录一、Kimi K3全球最大开源模型逼近前沿闭源二、WAIC 2026 开幕算力、智能体、机器人三线并进三、腾讯混元 Hy3MoE 架构 Apache 2.0 开源四、阿里通义千问实时语音与 Agent 编程双线升级五、DeepSeek V4484 天迭代技术报告全公开六、一句话快讯一、Kimi K3全球最大开源模型逼近前沿闭源7 月 16 日月之暗面发布Kimi K3成为目前全球参数规模最大的开源开放权重大模型。这一发布卡在 WAIC 开幕前一天节奏拉满。核心参数项目规格总参数约2.8 万亿2.7T–2.8T 口径不一架构高稀疏度 MoEMixture of Experts专家配置896 个路由专家每 token 仅激活 16 个上下文窗口100 万 token多模态原生支持视觉理解思考模式始终开启通过reasoning_effort控制思考力度API 定价输入 $3 / 输出 $15每百万 token权重开放计划7 月 27 日发布完整权重技术亮点Kimi K3 的架构建立在两项关键创新之上Kimi Delta AttentionKDA与Attention ResidualsAttnRes让信息在超长序列百万级 token和更深网络中流动得更顺畅实现高效的长上下文检索。Stable LatentMoE 高稀疏度框架在 896 个专家中稳定激活 16 个相比上一代 K2 实现约2.5 倍的整体可扩展性提升。在能力定位上官方主打长程编码long-horizon coding在极少人工监督下持续完成长时间工程任务、理解大型代码库、协调调用终端工具并擅长结合视觉反馈截图优化游戏开发、前端与 CAD 场景。性能与意义月之暗面称 K3 在多项测试中与 Anthropic 的 Fable 5 “旗鼓相当”在 GPU kernel 优化等测试中大幅领先 Opus 4.8、GPT-5.6 Sol 与 GPT-5.5。价格方面K3 输出 $15/百万 token虽高于 DeepSeek V4$0.87与 GLM-5.2$4.40但远低于 Fable 的 $50。点评分析师原本预期中国要到明年初才可能产出接近 Fable 级别的模型K3 把这个时间点提前了。它标志着开源与闭源在前沿能力上的差距正在功能性地收窄。不过 2.8 万亿参数的体量也意味着私有化部署门槛极高对多数企业并不现实。调用侧需注意K3 始终处于思考模式不要沿用 K2.x 的thinking参数改用顶层reasoning_effort当前仅支持max档位默认。二、WAIC 2026 开幕算力、智能体、机器人三线并进2026 世界人工智能大会暨人工智能全球治理高级别会议于 7 月 17—20 日在上海举行主题为智能伙伴共创未来。展览总面积首次突破 10 万平方米1100 余家企业参展超 300 款产品全球首发。从技术视角看三条主线值得关注1算力基础设施华为昇腾 950 超节点Atlas 950 SuperPoD以业界最大规模超节点的真机形态首次公开亮相为大模型时代提供底层算力支撑。沐曦股份首发曦景S 系列超节点东方算芯首发全球首颗软件定义近存计算 3D 芯片 DF1000。2基座模型与智能体阶跃星辰带来基于实时交互大模型的Step Audio Voice Agent采用快慢思考方案——语音模型负责前台实时交互复杂任务委托后台模型。MiniMax 上新MiniMax Code 2.0桌面端基于开源框架 Pi Agent 重构底层架构重点提升会话启动速度与长任务执行稳定性。百度将发布芯云模体全栈 AI 产品矩阵。3具身智能智元远征 A3 Ultra拿下 WAIC镇馆之宝身高 174cm搭载 700 TOPS 算力与自研计算架构配 360° 融合感知支持自主导航与动态避障。此外学术板块首设WAIC Academic由图灵奖得主姚期智担任大会主席已征集 9 个国家 284 篇论文强化学习之父 Richard Sutton 将作主旨演讲。三、腾讯混元 Hy3MoE 架构 Apache 2.0 开源7 月 6 日腾讯正式发布混元 Hy3HunYuan 3.0这是腾讯混元从闭源转向开源的标志性动作。架构MoE总参数295B、激活参数21B支持256K上下文定位快慢思考融合模型Agent 智能体能力突出协议Apache 2.0全球免费商用生态与微信生态、数字人、短视频深度打通可部署于华为昇腾芯片定价TokenHub 上输入 1 元 / 输出 4 元每百万 token上线势头强劲——发布一周Hy3 总调用量较上一代 Hy2 增长超68 倍。腾讯同期还推出翻译专用模型Hy-MT2系列其中 30B-A3B 版本在金融、法律、医疗等专业领域翻译测试中表现亮眼。四、阿里通义千问实时语音与 Agent 编程双线升级阿里通义千问近期密集更新Qwen-Audio-3.0-Realtime7 月 15 日实时语音交互对话模型在智商、Agent 工具调用、共情对话、双工交互流畅度四条主线同步升级。Qwen3.6-plus通用模型在Agent 编程能力上实现跃升尤其在仓库级repo-level复杂问题求解与前端开发领域树立新标杆默认支持百万 token超长上下文。生态侧网信中国公告显示Apple 智能大模型已于 7 月 8 日备案国行版苹果手机 AI 功能有望加速上线合作方包括阿里千问与百度搜索。五、DeepSeek V4484 天迭代技术报告全公开DeepSeek 团队发布V4 完整技术报告一次性公开从 V3去年 12 月到 V4 的 484 天迭代历程涵盖模型架构、训练策略、数据配比等核心细节。架构上V4 采用被称为DeepSeek Sparse AttentionDSA的稀疏注意力设计分为 V4-Pro1.6T 总参 / 49B 激活与 V4-Flash284B 总参 / 13B 激活。工程亮点包括国内首推峰谷分时计费夜间优惠降低企业长期调用成本、数学与代码达国产顶尖水准、推理速度提升 60%–80%并深度适配昇腾 910B/950。六、一句话快讯可灵 AI 融资快手可灵 AI 落地近 30 亿美元融资投后估值约 180 亿美元创全球视频大模型公司最大额融资纪录腾讯为联合领投方阿里云、百度参投。视频生成三强字节 Seedance、阿里 HappyHorse快乐马、可灵包揽 Artificial Analysis 文生视频榜单前三。华为智驾ADS 5.0 发布将世界模型作为核心技术路线全年自动驾驶投入 180 亿元。昆仑芯拟上市百度旗下 AI 芯片公司昆仑芯以约 500 亿美元目标估值推进港股上市。拟人化 AI 新规五部门出台新规字节豆包与阿里千问于 7 月 15 日下线用户自定义智能体功能。Intel Agent PC英特尔展示腾讯 QClaw、字节 TRAE、百度 DuMate、荣耀 YOYO Claw 等 PC 端 Agent 应用。结语如果说 2025 是追赶年2026 年年中的国产大模型已经进入并跑甚至部分领跑的节奏Kimi K3 把开源规模推到 2.8 万亿、逼近前沿闭源腾讯、阿里、DeepSeek 在开源、Agent、长上下文、分时计费等工程维度各有突破华为昇腾则从算力底座持续托举整个生态。WAIC 这几天还在进行中值得持续关注更多首发。本文为自动整理的资讯汇编部分未发布模型的具体参数与时间为社区/媒体口径请以官方公告为准。欢迎在评论区补充与讨论。参考来源China’s Moonshot AI releases Kimi K3, the largest open-source model ever — VentureBeatMoonshot AI Releases Kimi K3: 2.8T Parameter Open MoE Model — MarkTechPostKimi K3 快速开始 — Kimi 开放平台WAIC 2026 今天开幕超 300 款产品全球首发 — 新浪财经2026 世界人工智能大会官网Moonshot’s Kimi K3 pushes Chinese AI into Fable-level territory — Fortune郑工长·AI 洞察2026.07.09阿里百度牵手苹果 AI 国行版 — 新浪财经腾讯联合领投快手可灵 AI 落地近 30 亿美元融资 — 腾讯新闻
郑州网站建设
网页设计
企业官网