长发公主

无问芯穹夏立雪:智能体带来Token分层,国产芯片适配效果明显提升_我的网站

白露

一 |     

原标题:英特尔确认部分13代CPU产品搭载 VPU,14 代 Meteor Lake全面上线IT之家 9 月 14 日消息,在 TechTour 2022 上,英特尔表示很快将推出一项新的 AI 性能提升技术,该技术将首先与第 13 代 Raptor Lake CPU 一同亮相(小芯片 IP),并在胡须的 14 代 Meteor Lake CPU 上全面集成。    “今年上半年公司Token调用量7个月增长40倍,其中95%以上的推理任务来自智能体(Agent)需求。英特尔表示,除了广泛 VPU 的 Meteor Lake 产品线,他们还将与 OEM 伙伴合作,在部分 Raptor Lake 产品引入 VPU 设计,这意味着部分厂商的笔记本电脑有望支持 CPU。”          在2026WAIC期间,无问芯穹CEO夏立雪在接受澎湃新闻记者等媒体采访时表示,目前无问芯穹已在全国纳管16种不同架构芯片、合计3.7万P算力,过去一年已将推理成本降低至十分之一,未来全链路协同下仍有90%成本下降空间。         夏立雪认为,当前AI行业的核心矛盾从未改变:需求是指数级增长,芯片供给的增长是线性的,单纯堆芯片已经追不上需求增速。“大家不是觉得AI没用,是觉得它有点贵——这本身就是供不应求的信号,如果供大于求,大家只会觉得它没用。”          过去三年推理成本的下降,已经带动了第一批场景落地;他判断未来全行业仍有至少90%的成本下降空间,来源不只是单点技术优化,而是全链路协同:跨域异构集群的资源池化、PDD等新架构的普及,以及场景端的需求分层。据介绍,VPU 将提供多种功能,例如处理基于 Windows 的 AI 功能。         夏立雪认为,真正的生产力应该是“资源规模×Token生产效率×Token转化为生产力的效率”。此外,VPU 只会出现在联想惠普戴尔这种头部大厂的笔记本电脑中,这将成为 ISV 在技术完全集成后为 Meteor Lake CPU 做好准备的关键推动力。注意到之前宣传资料显示 Raptor Lake 将支持 AI M.2 Module,应指向同一内容,且不仅限于 Wccf 认为的移动端产品。目前全行业还在共创价值衡量指标,本质是计量每个Token产生的实际经济价值,推动行业从“按Token数量计费”转向“按最终价值计费”。除了 VPU,英特尔还谈到了他们将如何通过新的英特尔连接性能套件 2.0、WiFi 接近感应、蓝牙 LE 音频以及 WiFi 7 功能(5.1 Gbps)。         据了解,今年上半年,无问芯穹Token增量几乎全部来自Agent。Chipzilla 阐述了 VPU 在 AI 计算机视觉和 AI 驱动的计算图像处理方面的几个优势:
  • 人脸识别
  • 元宇宙 MetaVerse 和场景理解
  • 新兴用途:医疗保健和福利
IT之家曾报道,之前的爆料显示,14 代 Meteor Lake CPU 将采用三混合核心架构,包括 P-Cores、E-Cores 和全新的 LP E-Cores。简单来说“LP”将类似于 E 内核,但功率低得多,而且还有可能是部署在 Meteor Lake 芯片上的 VPU(视觉处理单元)内的 Atom 内核。“95%以上的推理任务跑的都是智能体相关任务,不管是直接服务大模型厂商,还是直接服务垂类客户,最终需求都来自Agent落地。

二 | ”夏立雪表示,目前代码生成、文娱营销、基础设施运维、具身智能、制造、电力、法律等行业都已经在大规模使用AI。

三 | 据介绍,Meteor Lake 芯片上只有两个 LP-E 内核,它们也只存在于 SOC Tile 上,这意味着这些是 VPU 使用的内核。因此,目前看起来 VPU 将成为英特尔在主流消费平台上在 AI 领域对抗 AMD AVX-512 能力的主要方式。         针对行业普遍关注的Token标准化问题,夏立雪明确判断:Token必然分层,且分层已经在发生。未来会出现面向高端复杂任务的高价值Token,也会有面向简单场景的高性价比Token。《英特尔 14 代 Meteor Lake 代码显示将搭载用于人工智能 / 深度学习的 VPU》返回搜狐,查看更多责任编辑:

。         这种分层直接带动了过去一年国产芯片的落地进展。他坦言,国产芯片适配效果的明显提升,一半来自技术端解决了跨集群调度、负载均衡等问题,更核心的原因是Agent带来了任务分层:智能体会派生大量不同复杂度的子任务,不需要所有任务都跑在最高端的芯片上,国产芯片可以承担自己擅长的任务,不用再“硬扛”最复杂的大模型训练负载。         “不同芯片各有侧重,都能在价值金字塔里找到自己的位置,不用浪费资源杀鸡用牛刀。”          夏立雪透露,目前无问芯穹已经在和行业客户探索多模型协同的分层交付模式,通过不同能力的模型配合完成任务,直接为最终结果负责。         对于今年的热点话题物理AI,无问芯穹宣布将具身智能场景纳入Token工厂的覆盖范围。         夏立雪表示,AI必然从数字世界走向物理世界,云侧GPU、边缘节点、机器人本体的算力都应该被纳入统一资源池调度,而团队过去在大规模云侧强化学习、跨集群调度上积累的能力可以直接复用,其发布的RLinf新版本已经实现真机渲染、训练到推理的全链路云边协同,Mizar-Robo推理优化方案已经和星海图、云深处等具身机器人厂商达成合作,优化机器人端侧推理效率,形成“机器人采集物理世界数据-云侧强化学习训练-端侧推理落地”的闭环。

四 | “我们不做机器人本体,就做好具身场景的Token工厂,给伙伴们提供低成本的弹药,让他们能以更低的成本推产品、拓市场。”          谈到AI赛道的行业竞争,在夏立雪看来,AGI不是单一公司能完成的使命,当前行业供需缺口还在持续扩大,只要技术能创造效率价值就有商业空间。近期智谱GLM、月之暗面Kimi等清华系开源大模型登顶国际榜单,中国的开源生态是核心优势,开源让技术、数据、资源能更快流动形成闭环,带动全行业效率提升。         当天,无问芯穹公布Agentic Infra 的“前店后厂一中心”战略布局,涵盖三大核心技术能力与产品服务体系:“算力集散中心”:Agentic Infra 自主式基础设施平台;“Token工厂”:Agentic MaaS 大模型服务平台;“AI生产力商店”: Agentic Infra 行业解决方案。

Current article:http://gwjg.xiadiaosengchengcun.shop/list_y10/jn38nr.html

Published on:02:58:03