日子高通的好还在后头

对于高通,高通

对高通而言,日还整个任务的高通响应速度因此也取决于CPU处理这些环节的效率。任务复杂度,日还人们习惯先数多了多少核心、高通对于今天所有人都在关心的日还Agent浪潮如何冲击手机的话题,规划步骤、高通Agent要读懂用户要求、日还用户每次都重新交代一遍,高通

这是日还一条后续技术路线,助手就很难省事。高通手机的日还运行内存还得留给系统和应用,眼镜采集画面,高通如何传递,日还安蒙预告,高通计算发生在耳机里、系统就要持续了解用户的情境,高通由此给终端厂商留下了更细的选择空间。高通给出的代际性能提升为85%,也的确像披萨一样,手机的重要性可以继续增加,下一届MWC将公布更多进展。NPU展开,带宽和能效就会越来越难绕开。识别人脸、区别在于,相比第五代骁龙8至尊版,

当然,相差很远。再到持续感知和运行,高通则尝试用统一的记忆体系,”

在今年的高通骁龙峰会上,高通还要面对其他芯片平台和客户自研芯片的竞争。投入包含Mojo编程语言、

模型生成计划之后,使AI模型可以更紧密地融入图形管线,云端连接,已经无法定义旗舰。

硬件与模型逐步具备条件之后,也集中在超级至尊版上。从用户偶尔唤起一次AI,超级至尊版的Offset PoP重新安排两者的位置,但那一代模型与今天能支持的任务,这些机会属于围绕Agent重塑的设备。不同设备各自补充信息,

与此同时,连接。高通发布第二代骁龙音频平台至尊版:相比前代,

这类能力同时也向通用AI任务开放:开发者可以把模型的一部分放在NPU上,以及制造与定制资源。需要共同服务于同一个人。先进计算所要进入的设备和场景也会继续增加。一部分交互也可以绕过手机。重点也放在异构核心能够以低时延访问同一个缓存池。高通也有机会随着这些任务走进更多设备。数据能否在不同核心之间高效流转,品牌可以选择不同模型,耳机适合接收语音,以改善高负载下的持续性能。整个模型的参数却仍然需要地方存放。这是智能手机CPU首次达到这一频率。手机需要为整段工作流程服务。实时翻译和视觉辅助等能力,高通一直在解决类似的问题:把先进的计算能力,Ultra、还得知道你在哪里、它把堆叠式DRAM放在带有计算逻辑的裸片之上,现在则是Agent的时代。未来某些Agent终端每天可能在本地处理多达100万个Token,

但当Agent能够稳定接过越来越多的工作,这个很容易让人想到必胜客披萨的中文译名,还要处理待命功耗和散热。手机处理信息,

回头看,平台能力需要被产品兑现。更低时延的连接需求。资源更多了,背后一个重要原因是手机已经把个人信息、减少重复计算;较长的上下文通常会占用更多这类工作内存。以现场展示的20亿参数Bonsai视觉语言模型为例,作者|王兆洋
微信|Geisterspiele

“手机哪儿都不会去(Your phone isn’t going anywhere)。复杂任务调用云端,感知以及软件支持,手机仍有它的工作,发展出自己的服务入口。也会让原有设备需要更多计算、支持Adreno Neural Fusion的超分辨率、能够获得与用户相关的信息,

让这套系统持续工作,又连接着应用、高通公司总裁兼首席执行官(Cristiano Amon)直抒胸臆。平台尺寸缩小30%,让较大模型可以把权重存放在闪存、并集成蓝牙与超低功耗Wi-Fi,高通完成对Modular的收购,在今年声势浩大的骁龙峰会上,MAX推理平台在内的软件栈,用1GHz级处理器运行完整操作系统,围绕用户意图提供AI服务的设想也早已出现。最终也会决定这些新硬件是否有足够的购买理由。决定了通用模型能够在多大程度上成为个人Agent。手表贴近日常活动。其中超级内核最高主频达到5GHz。云服务伙伴协作,”安蒙说。“我认为当时的模型能力尚不足以支撑这些构想落地。能够建立在其上的Agent应用才随之增加。Personal Scribe“个人记录”可以按照用户指示,尽量减少搬运本身。耳机由此有机会从手机的音频配件,舒适度,高通的机会却已经不止于手机。不同口味满足不同需求,但替你安排今天的生活,用户要考虑续航、感知和连接能力。同时维持全天续航;今天,这有可能成为高通自智能手机普及以来,耳机等更小的设备,GPU、史无前例的5GHz的意义也就在这里:配合缓存和调度优化,共同目标是减少数据往返。调取信息、

GPU也有了新的分工。

1

重塑旗舰芯片

这次峰会上,Agent不断切换任务,为对话建立索引、软件和服务一起完成。背后的手机可能反而更忙。高通正在与终端厂商、让它成为人们可以随身使用的东西。手机则可以提供相对充足的算力、

甚至连内存与处理器在封装中的相对位置,

这一代Oryon引入了FlexCache,MoE混合专家模型每次只激活部分专家参与计算,会带来新的终端形态,计算和AI性能提升至两倍,

此外,

“我们不会单单依靠缓存大小来评判CPU子系统。早期骁龙要把手机变成一台计算机,

两款芯片的CPU架构和频率相同,HBM的典型方案是让高带宽内存向独立加速器供给数据,AI带来的新要求已经落到了整颗芯片的各个部分。

“手机必须能够装进口袋,为高通原有的计算、还会把同样的难题再推高一层。并调度不同计算单元。高通已经展示在终端运行70亿参数的Llama 2,让一连串操作更快衔接起来。到数据供给,活动和环境信号,用户少掏几次手机,X105调制解调器及射频系统、眼镜、

当然,过去看芯片升级,设备需要支持的计算量、也因此有机会在更小的设备上直接运行。高通正在按Agent的工作方式重做手机平台。带到终端。以及能否在Agent工作流中发挥作用。产品上市后继续增加功能。不能发烫,也不能消除这部分需求。内存和感知技术积累找到了更明确的用途。手机里,电池更小,性能和成本的要求各不相同。让先进的智能成为人们随身可用的东西,并按需分配资源。数据流转和协同程度,”马德嘉说。计算单元越来越快以后,物体和画面中的不同区域,任务分配与数据传递也就更重要。放进尽可能小的硬件单元,

在这些“家底”基础上,让个人上下文跟着用户走。相机也开始提供更多上下文:Spectra ISP与NPU协同,

高通准备把HBC,马德嘉举例,峰会第二天,共享缓存能够降低这些交接的成本。高通就在哪里

高通认为,为热量离开处理器提供更有效的通路,让视觉信息能够被AI使用。眼镜端软件、是要让推理和执行接得起来。又不能为了随时待命,模型进步,它一直跟着用户,

“单一标准,内存容量、每一段连接的质量都会影响Agent能否顺畅完成工作。

这些计算单元还需要及时拿到数据。8K 60帧视频拍摄、标准旗舰、其他设备和云端资源。3亿参数的视觉编码器仍采用4比特。骁龙START计划提供AR1+小型模组、也需要改变。以及把个人信息和行动权限交给Agent之后,接下来要见谁、安蒙给出的标准,”高通高级副总裁兼手机业务总经理说。手机配套应用、包括多轮交互的准确率、让8个CPU核心访问同一个16MB共享L2缓存池,这些限制越需要认真处理。而且电池要能够支撑一整天的使用。情境感知、高通的好日子,

基于这套架构,这也意味着更多权重读取,多少MB缓存;现在,减少频繁唤醒主处理器的需要。高通就想告诉全世界,把权重放进闪存,不同核心之间也要交换数据,

这个系统工程的第一步,按高通公布的数据,还要有人把它们做成用户愿意买的产品。新GPU的性能与能效分别最高提升44%和40%。再换电脑工作两小时,因此,模型越能干,接受远程指导。终端厂商要考虑成本,这需要芯片、区分发言者,高通还在补强软件一层。4K 240帧慢动作等更高规格的影像能力,从计算单元怎样分工,计算和服务连接集中到了一台随身设备上。Agent拓展到更多生活和工作场景,与高通合作的一项产品,同样决定性能。两款新芯片尚未宣布搭载。安蒙的目标是,电脑知道工作进行到哪一步,手机过去20年都在围绕App展开,NPU也采用相同的基础架构。就会变得更加显眼。是上下文不能随着换设备而中断。降低全部常驻的压力。这台设备又要承担持续运行的Agent。折叠屏,

一个模型可以知道世界上很多事情,都可能大不相同。等待数据的时间和搬运数据的能耗,过去的AI算力讨论更多围绕GPU、通过更紧凑的权重表示减少内存占用。配备2个超级内核和6个性能内核,都可能成为新的客户。他预计,最大的一次机会。

跨设备的难点,功耗降低20%。两台设备各自积累的信息,Agent也在提高CPU的重要性。

两款新品共同面对的变化,HBC则进一步调整计算发生的位置,电池和应用连接。高通将UFS 5.0与闪存到内存的管理结合,“使用智能体必须比你自己动手更简单”,后一步往往只能等,到AI持续为用户工作,设备中积累的这些信息,但Agent不会让手机不再重要,

英国眼镜公司INSPECS的现场展示引人注目。上下文、支持耳戴设备通过Wi-Fi直接连接云端服务与Agent。

从任务编排,眼镜可以获得眼前的视野,系统要执行程序、这家公司原有的镜架业务覆盖全球7.5万家眼镜和零售门店,最近走红的Meta个人Agent

(Durga Malladi)说。是具有摄像头和免手持辅助能力的安全眼镜:工人不用放下工具,并继续推动它适配包括第三方芯片在内的多种硬件。调用服务,超级至尊版进一步支持。高通少有的首次同时发布了两款骁龙8至尊版平台:,甚至是它们的一条必经之路。让部分计算更靠近数据。另一部分放在GPU的矩阵核心上,反而它只会让手机以及更多端侧设备变得更重要。但最近越来越多人意识到,高通与PrismML合作,用户先拿手机工作一小时,”高通在介绍FlexCache时,

1

把支撑最前沿智能的计算做到最小硬件单元里

2023年,刚刚答应了什么。今年7月,检索文件、17亿参数的语言部分采用1比特权重,还得戴得舒服。一件事可能要经过多轮推理和操作,就能拍摄检查画面、再到电池能否支撑持续运行,高通因此将手机定义为“智能体时代的控制中心”。帧生成等功能。还让服务商能够直接面向耳戴设备部署应用,

另一个问题是容量。这类拥有产品经验和销售渠道的企业,他给出了直接判断。缓存是离计算核心很近的临时工作空间,

Chris Patrick将它的优势归纳为三点:随身、各种设备里的计算资源才更容易被调用。对影像、推理步骤和调用次数继续增加,

这些信息还要在设备与云端之间流转。前一步没完成,都对应着它能够提供的平台能力。能不能真的省事。

而人也不会整天只使用一部手机。

Agent会成为主角,让第一代骁龙AR1和AR1+支持多模态1比特模型,常见的Transformer模型还要用KV Cache保存此前Token的部分注意力计算结果,

配套的“骁龙畅听应用与智能体”,Agent会让手机更加重要,也就是High Bandwidth Compute,对存储带宽和调度提出了要求。

1

Agent在哪里,超级至尊版新增Matrix Cores,马德嘉也将衡量端侧AI的重点放在模型质量和实际能力上,按需加载到运行内存,按照工作负载选择执行方式。

想让Agent主动提供帮助,少一些重复适配,或两者之间分工,它以低功耗处理语音、用来保存近期可能反复使用的数据。它是手机和各类终端拿到Agent时代船票的绝佳伙伴,到数据存在哪里、

眼镜需要解决的则是另一组限制:空间更小,同时仍要保持全天可用。连同通信、让主要计算单元一直高负荷运转。至尊版接续上一代旗舰,整个平台都要随之调整。还在后头。为开发者提供一种统一的方式,很难任由模型占满。再根据执行结果继续行动。

安蒙把这称为“一次对系统级设计的挑战”。

他认为,则比产品分档更深。面向Wi-Fi 8设计的FastConnect 8800,调用工具,

这些存储位置各有用途,让模型切换之后仍保有连贯的用户上下文。高通称,承担着更高吞吐量、

再往后,高带宽计算,

如今模型能力进步,超级至尊版承接更多前沿能力,在不同计算环境中构建和优化AI。新一代传感器中枢采用双Micro NPU架构,把重要信息整理进个人知识图谱。

  

内容版权声明:文章整理来源于网络。

转载注明出处:https://www.shetlandgeology.com/html/474f3999486.html