人龙传说

英伟达新一代算力平台补齐拼图 结合DeepSeek模型Token成本可降35倍_我的网站

越狱第四季

A |     K图 NVDA_0  英伟达硬件演进正加速驶向下一站,为智能体(Agent)打造新一代算力平台。     8 月 26 日消息,据上海广播电视台 8 月 25 日报道,两名男子利用某新能源车企 App“先充后付”功能的规则漏洞,通过 870 多个虚拟手机号反复绑定子账号充电后拒不付款,再将“免费充电位”倒卖给大货车司机,不到一个月累计造成车企电费损失超 40 万元。上海市浦东新区人民检察院认定两人行为已构成诈骗罪,目前已对嫌疑人梁某、张某批准逮捕。  当地时间8月24日,英伟达宣布,推理加速器Groq 3 LPX机架已进入全面量产阶段。注意到,该新能源车企推出的“先充后付”功能允许车主通过 App 绑定多个子账号,每个子账号可享受两次“先充电、后付款”的额度,在第三次充电后统一结算。嫌疑人梁某与张某在一个顺风车群中相识,梁某了解到张某的新能源车品牌后,要求张某将其提供的虚拟手机号授权为 App 共同用车人。

B | 在确认充电账单仅发送给子账号、与主账号无关后,两人商定利用该漏洞非法获利。英伟达高级总监Dion Harris表示,Groq机架将与Vera中央处理器和Rubin图形处理器一同部署在新型云服务商Nebius的数据中心,并将于今年晚些时候上线。梁某从网络平台购买了 870 多个虚拟手机号,每日向张某支付 800 元报酬,让其反复执行“绑定子账号、充电两次、立即解绑”的操作。  Groq 3 LPX机架是英伟达专为Vera Rubin平台设计的推理加速扩展组件,需与 Vera Rubin NVL72 GPU主机架搭配部署——NVL72负责更广泛的训练、推理以及上下文处理,LPX专门加速输出AI生成结果(Token),主打超低延迟Token生成,两者异构协同,可大幅提升万亿参数、超长上下文智能体推理的每瓦吞吐与交互响应速度。  英伟达此前将Vera Rubin平台定义为专为智能体AI与科学计算时代设计的机架级超级计算平台。随后梁某将这些“免费充电位”挂在网上,以每单 80 至 120 元的价格转卖给大货车司机。梁某交代,一辆重卡充满电约需 600 度电、耗时 3 小时,因其提供的充电价格低廉,已积累了不少固定客户。

C | 今年 5 月,涉事车企排查时发现某主账号名下异常频繁地更换了 870 多个子账号,每个子账号均为充电两次后即解绑。

D | 英伟达此次将Groq 3 LPX正式推向全面生产,核心目的并不是用专用推理芯片取代GPU,而是为Vera Rubin补充传统GPU架构在低延迟Token生成方面的能力。从 4 月至案发,累计未支付电费已超过 40 万元,向子账号发送的催缴通知均未收到任何回复。  相比Blackwell,Vera Rubin在智能体工作上的效率得到了极大的提升,英伟达释出多个最新测试数据(本次测试使用的基准为SemiAnalysis AgentX,该基准针对Kimi K3、MiniMax M3、GLM5.3、Qwen3.5、DeepSeek V4 Pro等各类模型)——   英伟达称,在Artificial Analysis测试中,搭载Gemma 4 31B模型、100K Token上下文时,Groq 3 LPX实现每秒3400个输出Token,为该模型创下最高纪录;针对智能体编程等低延迟工作负载,其响应速度最高达到最近竞争平台的4倍。5 月 20 日,涉事公司向警方报案,梁某、张某随后落网。上海市浦东新区检察院认定,两人虽实施的是窃电行为,但所涉罪名为诈骗罪而非盗窃罪。英伟达称,这种速度可以让智能体更快完成代码编写、测试、工具调用和结果验证等连续任务。检方认为,二人利用虚拟手机号骗取车企充电服务,使企业“认错人”而白掏电费,符合诈骗罪“虚构事实、隐瞒真相、以非法占有为目的”的构成要件。  与此同时,英伟达公布Vera Rubin NVL72在真实智能体工作负载下的新测试结果:基于SemiAnalysis的AgentX工作负载、采用DeepSeek V4 Pro模型,Vera Rubin每兆瓦(MW)吞吐量最高达到上一代GB300 NVL72的30倍,每Token成本最高降低35倍。对于运营商而言,这意味着在固定的电力和基础设施预算下,可以支持更高的交互式代理容量,或者以更低的运营成本提供相同的容量。在讯问中,梁某和张某均表示愿意积极退赔,梁某称其妻子已将家中房屋挂牌出售,愿用卖房款赔偿涉事车企的全部损失。imageimage  英伟达强调,智能体任务不同于传统聊天对话,任务上下文会随着数百个步骤不断累积,甚至达到数十万Token。广告声明:文内含有的对外跳转链接(包括不限于超链接、二维码、口令等形式),用于传递更多信息,节省甄选时间,结果仅供参考,包含外链的文章均包含本声明。英伟达援引OpenRouter数据称,智能体AI工作负载消耗的Token数量可以达到简单聊天请求的15倍。

E | 原因在于,一个智能体可能先查询数据库,再搜索新闻和文件,调用子智能体进行分析,运行代码并反复验证,整个过程中上下文不断累积。

F |   近期腾讯、阿里、DeepSeek等头部厂商相继推进AI智能体产品迭代与生态布局,AI应用端发展聚焦终端场景落地与生态壁垒搭建。

G | 天风国际证券最新研报称,当前Harness加速开放迭代,前沿AI竞争正向Agent执行框架与商业化兑现深化。  英伟达正紧随这一趋势调整硬件优化方向,当AI迈入智能体时代,AI基础设施的评价体系或将随之变化,基础设施服务商的硬件迭代重心将从追求训练更大模型,转向单位能耗有效Token产出、单位成本任务处理能力,以及智能体复杂任务的执行时延。(文章来源:财联社)。

H |

Current article:http://www.bianhajieleigoukusunmen.pics/l21kn4/mo1z8n.xls

Published on:09:41:36


我的网站热点内容