主页搜索
搜索
选择时间
搜索范围
全部的
‘AI推理’新闻 4个
-
华为成功突破长文AI推理瓶颈,速度提升最大达372%华为在中国通信行业首次成功将长文(long-sequence)AI推理的令牌处理能力提升至最大372%。 华为于24日(当地时间)在中国上海举行的'MWC上海2026'上与中国移动湖北公司共同发布了'AI推理加速解决方案'的验证成果。 该解决方案基于华为的OceanStore A800存储、Ascend A3超级计算平台和统一缓存管理器构建,为通信公司有效部署大规模AI计算服务奠定了核心技术基础。 随着AI服务向代理中心演变,处理代码生成和多轮对话等长文场景的需求不断增加。然而,由于现有的片上内存和DRAM的限制,数据处理出现了延迟瓶颈。 为了解决这一问题,华为引入了利用外部高性能存储的UCM技术,实现了PB级的大容量KV缓存,并消除了重复计算,大幅降低了推理成本。 此次验证在中国移动湖北的商用网络中进行,模拟了包括MiniMax M2.5和GLM-5.1等主要AI模型在内的8K至190K令牌的长文输入。 验证结果显示,GLM-5.1模型的首个令牌生成时间(TTFT)缩短了最多93%。在128K长文环境下,每秒令牌数(TPS)提升了最大372%。MiniMax M2.5模型在128K环境下TPS也增加了78%,随着上下文窗口的延长,加速效果愈加明显。 迈克尔·朱,华为全球数据存储市场与解决方案销售部总裁表示:“AI推理加速解决方案不仅大幅缩短了响应时间,还帮助降低了令牌成本。我们将全力支持通信公司构建高效、环保的AI计算基础设施。”※ 本报道经人工智能(AI)系统翻译与编辑。
2026-06-28 19:32:00 -
诺塔首季订单达118亿,AI轻量化技术实现飞跃【经济日报】AI轻量化技术公司诺塔(代表蔡明洙)在2026年第一季度实现了118亿韩元的订单额,同比增长111%。这一成就是由于诺塔的AI模型优化平台“NetsPresso”通过了三星电子、Arm和FuriosaAI等全球半导体企业的严格验证,并开始正式供应技术。这表明AI行业的重心正在从开发大型模型转向“高效运营”。随着生成型AI模型规模的迅速扩大,所需的计算成本和电力消耗成为行业的主要难题。尤其在智能手机和自动驾驶汽车等“设备端AI”环境中,直接搭载大型模型在物理上是不可能的。在此背景下,诺塔的“AI轻量化”技术显得尤为重要。NetsPresso平台在保持AI模型性能的同时,大幅缩小其体积,使低配置的边缘设备也能顺畅运行AI。这项技术不仅降低了数据中心的建设成本,还提高了AI服务的响应速度。诺塔的TurboQuant技术因此受到市场关注,随着市场对推理效率和内存优化的需求增加,诺塔的技术已成为“必需品”。诺塔的技术价值通过与三星电子、Arm和FuriosaAI等全球半导体企业的连续订单合同得到了证明。与三星电子的合同展示了其在设备端AI领域的技术实力,而与Arm的合作则表明诺塔已成为全球AI生态系统的核心参与者。Arm正在将AI生态系统扩展到数据中心、汽车和机器人领域。诺塔的优化技术有望成为Arm基础的多种计算环境中最大化硬件性能的“软件层”标准。这意味着诺塔不仅是一个技术供应商,还可能成为所有参与Arm生态系统的开发者必须使用的“必备平台”。解决方案部门的增长也令人瞩目。基于视觉语言模型(VLM)的图像分析解决方案“诺塔视觉代理(NVA)”不仅能识别对象,还能通过推理判断图像的上下文和情况。这使得实时情况总结和报告成为可能,扩大了在造船、智能交通系统(ITS)、制造等多个行业的应用范围。全球汽车零部件企业等多种客户群体在技术验证后转为实际合同的案例增加,显示出NVA的技术成熟度和现场适用性已获得市场信任。未来,诺塔将通过平台和解决方案两翼加速增长。在平台方面,将扩大与半导体及计算环境的合作范围;在解决方案方面,将通过行业定制供应增强市场主导力。蔡明洙代表表示:“我们将把获得的订单转化为客户成果,巩固在AI优化市场的技术领导地位。”在AI模型“瘦身”技术决定企业生存的时代,诺塔的表现成为K软件企业成长为全球半导体供应链核心伙伴的典范。与此同时,AI的未来不在于“制造更大的模型”,而在于“更高效的运营”。诺塔为这一问题提供了最明确的答案。未来,诺塔能否从AI半导体市场的“隐形强者”成长为全球AI优化市场的“游戏规则改变者”,值得关注。※ 本报道经人工智能(AI)系统翻译与编辑。
2026-04-07 19:48:00 -
三星电子目标价34万韩元,SK海力士170万韩元:麦格理眼中的“存储大爆炸”全球半导体市场正处于结构性转型期,因AI市场重心从‘学习’转向‘推理’。麦格理证券将三星电子和SK海力士的目标股价分别上调至34万韩元和170万韩元,背后是AI服务普及引发的存储供需变化。AI产业结构重塑了半导体需求格局。据金融投资业界25日消息,麦格理证券在当天发布的报告中,将三星电子和SK海力士的评级从中立上调至买入,理由是存储供应短缺加剧,AI市场的转变是关键因素。报告指出,过去2至3年是AI模型性能提升的‘学习’阶段,预计2026年前后将进入‘推理’阶段,半导体需求重心也在变化。在学习阶段,GPU和高带宽存储(HBM)是关键。但在推理环境中,实时数据处理量激增,通用DRAM和企业级SSD(eSSD)的重要性迅速上升。麦格理预计,这种结构变化可能导致部分存储产品合同价格短期内大幅上涨。供应限制加剧了价格上涨压力。三星电子、SK海力士和美光等主要存储企业专注于盈利更高的HBM生产,导致通用DRAM生产比例下降,出现‘挤出效应’。HBM比普通DRAM需要更多晶圆,侵蚀了通用产品的供应。新工厂建设需要数年时间,供应扩张速度有限。麦格理认为,这种供需不平衡可能持续到明年。花旗集团也在最近的报告中提到,2026年DRAM和NAND价格可能大幅上涨,支持存储强势论。这种环境可能对三星电子有利。凭借平泽P4和P5工厂的大规模生产能力,三星电子在通用存储供应短缺中具有相对优势。麦格理因此大幅上调了三星电子的每股收益(EPS)预期。SK海力士也因在HBM市场的技术优势,预计将直接受益于AI基础设施投资的扩大。与英伟达等主要客户的合作关系,以及通用存储价格上涨,可能进一步提升其盈利能力。然而,业界也提出了谨慎观点。若AI基础设施投资放缓或大科技公司扩大自研芯片开发,需求增长可能调整。数据中心电力供应等基础设施限制也是变量。业内人士表示,“AI推理市场的扩张确实增加了存储需求,但随着供应瓶颈的缓解和投资速度的变化,价格波动性可能加大,需警惕过度乐观。”尽管如此,麦格理的报告表明,AI时代半导体行业的主导权正在重新转向存储企业。韩国存储企业能否在AI技术转型中再创超级周期,市场关注度正集中于此。※ 本报道经人工智能(AI)系统翻译与编辑。
2026-02-26 00:21:00 -
SKT在MWC26展示AI全栈战略,拓展全球市场SK电信(CEO郑在宪)在世界最大移动展会MWC 2026上展示其AI全栈战略,计划通过AI数据中心(AIDC)基础设施和大型语言模型(LLM)服务,挑战全球科技巨头。SK电信宣布将在3月2日于西班牙巴塞罗那开幕的MWC 2026上设立独立展馆,主题为“创造无限可能的SKT AI”。此次展览是郑在宪CEO上任后加速AI转型的首次全球展示。展览的核心是AI基础设施。SK电信将利用去年在蔚山建立的国内最大AIDC和高性能GPU集群“海印”的经验,进军全球市场。SK电信提供的解决方案包括AI DC基础设施管理器和K-主权GPU即服务(GPUaaS),旨在最大化运营效率。这些解决方案符合全球“主权AI”趋势,吸引各国通信公司和政府机构。SK电信推出的AI推理工厂针对高成本和高能耗问题,满足全球客户对成本效益的需求。◆ '独立AI模型' 2阶段 'A.X K1',全球LLM竞争SK电信展示了进入政府“独立AI基础模型”项目第二阶段的“A.X K1”。该模型拥有5190亿参数,擅长韩语、英语及通信数据。与OpenAI和谷歌的通用模型不同,A.X K1专为通信公司设计。在物理AI领域,SK电信展示了数字孪生、机器人训练平台和视觉解决方案“SynapseGo”,展示AI在制造和物流等实物产业的应用。业内分析认为,MWC将加强SK电信主导的全球电信AI联盟(GTAA)的凝聚力,并扩大其影响力。SK电信与德国电信、新加坡电信和软银合作,通过此次展览向合作伙伴展示其AI全栈解决方案。SK电信的AI-RAN技术和6G网络发展方向展示了其在通信和AI结合领域的技术领导力。郑在宪CEO将在现场与全球通信公司和科技巨头高管会面,推动AI销售。他表示:“此次MWC是展示SKT如何将通信基础的AI技术转化为实际业务的平台,我们将通过全栈竞争力提升SKT在全球生态系统中的地位。”全球ICT行业关注SK电信在巴塞罗那发出的“K-AI”信号如何影响全球AI市场。※ 本报道经人工智能(AI)系统翻译与编辑。
2026-02-22 22:57:00
-
华为成功突破长文AI推理瓶颈,速度提升最大达372%华为在中国通信行业首次成功将长文(long-sequence)AI推理的令牌处理能力提升至最大372%。 华为于24日(当地时间)在中国上海举行的'MWC上海2026'上与中国移动湖北公司共同发布了'AI推理加速解决方案'的验证成果。 该解决方案基于华为的OceanStore A800存储、Ascend A3超级计算平台和统一缓存管理器构建,为通信公司有效部署大规模AI计算服务奠定了核心技术基础。 随着AI服务向代理中心演变,处理代码生成和多轮对话等长文场景的需求不断增加。然而,由于现有的片上内存和DRAM的限制,数据处理出现了延迟瓶颈。 为了解决这一问题,华为引入了利用外部高性能存储的UCM技术,实现了PB级的大容量KV缓存,并消除了重复计算,大幅降低了推理成本。 此次验证在中国移动湖北的商用网络中进行,模拟了包括MiniMax M2.5和GLM-5.1等主要AI模型在内的8K至190K令牌的长文输入。 验证结果显示,GLM-5.1模型的首个令牌生成时间(TTFT)缩短了最多93%。在128K长文环境下,每秒令牌数(TPS)提升了最大372%。MiniMax M2.5模型在128K环境下TPS也增加了78%,随着上下文窗口的延长,加速效果愈加明显。 迈克尔·朱,华为全球数据存储市场与解决方案销售部总裁表示:“AI推理加速解决方案不仅大幅缩短了响应时间,还帮助降低了令牌成本。我们将全力支持通信公司构建高效、环保的AI计算基础设施。”※ 本报道经人工智能(AI)系统翻译与编辑。
2026-06-28 19:32:00 -
诺塔首季订单达118亿,AI轻量化技术实现飞跃【经济日报】AI轻量化技术公司诺塔(代表蔡明洙)在2026年第一季度实现了118亿韩元的订单额,同比增长111%。这一成就是由于诺塔的AI模型优化平台“NetsPresso”通过了三星电子、Arm和FuriosaAI等全球半导体企业的严格验证,并开始正式供应技术。这表明AI行业的重心正在从开发大型模型转向“高效运营”。随着生成型AI模型规模的迅速扩大,所需的计算成本和电力消耗成为行业的主要难题。尤其在智能手机和自动驾驶汽车等“设备端AI”环境中,直接搭载大型模型在物理上是不可能的。在此背景下,诺塔的“AI轻量化”技术显得尤为重要。NetsPresso平台在保持AI模型性能的同时,大幅缩小其体积,使低配置的边缘设备也能顺畅运行AI。这项技术不仅降低了数据中心的建设成本,还提高了AI服务的响应速度。诺塔的TurboQuant技术因此受到市场关注,随着市场对推理效率和内存优化的需求增加,诺塔的技术已成为“必需品”。诺塔的技术价值通过与三星电子、Arm和FuriosaAI等全球半导体企业的连续订单合同得到了证明。与三星电子的合同展示了其在设备端AI领域的技术实力,而与Arm的合作则表明诺塔已成为全球AI生态系统的核心参与者。Arm正在将AI生态系统扩展到数据中心、汽车和机器人领域。诺塔的优化技术有望成为Arm基础的多种计算环境中最大化硬件性能的“软件层”标准。这意味着诺塔不仅是一个技术供应商,还可能成为所有参与Arm生态系统的开发者必须使用的“必备平台”。解决方案部门的增长也令人瞩目。基于视觉语言模型(VLM)的图像分析解决方案“诺塔视觉代理(NVA)”不仅能识别对象,还能通过推理判断图像的上下文和情况。这使得实时情况总结和报告成为可能,扩大了在造船、智能交通系统(ITS)、制造等多个行业的应用范围。全球汽车零部件企业等多种客户群体在技术验证后转为实际合同的案例增加,显示出NVA的技术成熟度和现场适用性已获得市场信任。未来,诺塔将通过平台和解决方案两翼加速增长。在平台方面,将扩大与半导体及计算环境的合作范围;在解决方案方面,将通过行业定制供应增强市场主导力。蔡明洙代表表示:“我们将把获得的订单转化为客户成果,巩固在AI优化市场的技术领导地位。”在AI模型“瘦身”技术决定企业生存的时代,诺塔的表现成为K软件企业成长为全球半导体供应链核心伙伴的典范。与此同时,AI的未来不在于“制造更大的模型”,而在于“更高效的运营”。诺塔为这一问题提供了最明确的答案。未来,诺塔能否从AI半导体市场的“隐形强者”成长为全球AI优化市场的“游戏规则改变者”,值得关注。※ 本报道经人工智能(AI)系统翻译与编辑。
2026-04-07 19:48:00 -
三星电子目标价34万韩元,SK海力士170万韩元:麦格理眼中的“存储大爆炸”全球半导体市场正处于结构性转型期,因AI市场重心从‘学习’转向‘推理’。麦格理证券将三星电子和SK海力士的目标股价分别上调至34万韩元和170万韩元,背后是AI服务普及引发的存储供需变化。AI产业结构重塑了半导体需求格局。据金融投资业界25日消息,麦格理证券在当天发布的报告中,将三星电子和SK海力士的评级从中立上调至买入,理由是存储供应短缺加剧,AI市场的转变是关键因素。报告指出,过去2至3年是AI模型性能提升的‘学习’阶段,预计2026年前后将进入‘推理’阶段,半导体需求重心也在变化。在学习阶段,GPU和高带宽存储(HBM)是关键。但在推理环境中,实时数据处理量激增,通用DRAM和企业级SSD(eSSD)的重要性迅速上升。麦格理预计,这种结构变化可能导致部分存储产品合同价格短期内大幅上涨。供应限制加剧了价格上涨压力。三星电子、SK海力士和美光等主要存储企业专注于盈利更高的HBM生产,导致通用DRAM生产比例下降,出现‘挤出效应’。HBM比普通DRAM需要更多晶圆,侵蚀了通用产品的供应。新工厂建设需要数年时间,供应扩张速度有限。麦格理认为,这种供需不平衡可能持续到明年。花旗集团也在最近的报告中提到,2026年DRAM和NAND价格可能大幅上涨,支持存储强势论。这种环境可能对三星电子有利。凭借平泽P4和P5工厂的大规模生产能力,三星电子在通用存储供应短缺中具有相对优势。麦格理因此大幅上调了三星电子的每股收益(EPS)预期。SK海力士也因在HBM市场的技术优势,预计将直接受益于AI基础设施投资的扩大。与英伟达等主要客户的合作关系,以及通用存储价格上涨,可能进一步提升其盈利能力。然而,业界也提出了谨慎观点。若AI基础设施投资放缓或大科技公司扩大自研芯片开发,需求增长可能调整。数据中心电力供应等基础设施限制也是变量。业内人士表示,“AI推理市场的扩张确实增加了存储需求,但随着供应瓶颈的缓解和投资速度的变化,价格波动性可能加大,需警惕过度乐观。”尽管如此,麦格理的报告表明,AI时代半导体行业的主导权正在重新转向存储企业。韩国存储企业能否在AI技术转型中再创超级周期,市场关注度正集中于此。※ 本报道经人工智能(AI)系统翻译与编辑。
2026-02-26 00:21:00 -
SKT在MWC26展示AI全栈战略,拓展全球市场SK电信(CEO郑在宪)在世界最大移动展会MWC 2026上展示其AI全栈战略,计划通过AI数据中心(AIDC)基础设施和大型语言模型(LLM)服务,挑战全球科技巨头。SK电信宣布将在3月2日于西班牙巴塞罗那开幕的MWC 2026上设立独立展馆,主题为“创造无限可能的SKT AI”。此次展览是郑在宪CEO上任后加速AI转型的首次全球展示。展览的核心是AI基础设施。SK电信将利用去年在蔚山建立的国内最大AIDC和高性能GPU集群“海印”的经验,进军全球市场。SK电信提供的解决方案包括AI DC基础设施管理器和K-主权GPU即服务(GPUaaS),旨在最大化运营效率。这些解决方案符合全球“主权AI”趋势,吸引各国通信公司和政府机构。SK电信推出的AI推理工厂针对高成本和高能耗问题,满足全球客户对成本效益的需求。◆ '独立AI模型' 2阶段 'A.X K1',全球LLM竞争SK电信展示了进入政府“独立AI基础模型”项目第二阶段的“A.X K1”。该模型拥有5190亿参数,擅长韩语、英语及通信数据。与OpenAI和谷歌的通用模型不同,A.X K1专为通信公司设计。在物理AI领域,SK电信展示了数字孪生、机器人训练平台和视觉解决方案“SynapseGo”,展示AI在制造和物流等实物产业的应用。业内分析认为,MWC将加强SK电信主导的全球电信AI联盟(GTAA)的凝聚力,并扩大其影响力。SK电信与德国电信、新加坡电信和软银合作,通过此次展览向合作伙伴展示其AI全栈解决方案。SK电信的AI-RAN技术和6G网络发展方向展示了其在通信和AI结合领域的技术领导力。郑在宪CEO将在现场与全球通信公司和科技巨头高管会面,推动AI销售。他表示:“此次MWC是展示SKT如何将通信基础的AI技术转化为实际业务的平台,我们将通过全栈竞争力提升SKT在全球生态系统中的地位。”全球ICT行业关注SK电信在巴塞罗那发出的“K-AI”信号如何影响全球AI市场。※ 本报道经人工智能(AI)系统翻译与编辑。
2026-02-22 22:57:00