搜索关键词 生成速度
AI & Enterprise
NVIDIA宣布Groq 3 LPX进入量产:面向AI代理,基准测试生成速度最高达每秒3400个token
NVIDIA宣布,面向AI代理的推理加速器Groq 3 LPX已进入量产,并在Hot Chips 2026上正式亮相。该方案可与Vera Rubin NVL72配合,将长上下文处理与解码环节拆分。在Artificial Analysis基准测试中,Groq 3 LPX在10万token上下文窗口下运行Gemma 4 31B时,生成速度最高达到每秒3400个token。Nebius Group等企业将率先部署这一方案。
Industry
NVIDIA在Hot Chips 2026发布多项新品,瞄准AI推理Token生成速度
在Hot Chips 2026大会上,NVIDIA赶在二季度财报发布前推出多款面向AI推理和网络基础设施的新产品,包括启动量产的Grok 3 LPX、以太网扩展方案Spectrum-X Multiplane以及基础设施加速方案ScaleIn。公司同时披露,Vera CPU已被SpaceXAI采用;整体布局聚焦AI推理阶段的Token生成速度、网络扩展能力以及面向AI智能体的计算架构。
AI & Enterprise
Aviator CEO:AI写代码越多,软件组织越将走向“开发工具公司”
开发者生产力平台Aviator联合创始人兼CEO Ankit Jain表示,随着AI承担越来越多的代码生成工作,软件组织的重心将从“直接写代码”转向“构建生成代码的工具和平台能力”。在这一过程中,工程师角色将进一步分化为产品工程师和平台工程师,后者需要统一管理模型选型、权限管理、使用规模与反馈闭环,避免各团队重复建设、各自为战。
-
AI & Enterprise
Anthropic公开Claude文本水印机制:彻底改写后会消失
-
Crypto
David Schwartz驳斥“Bitcoin Knots攻击比特币网络”说法:这是在误导不了解情况的人
-
AI & Enterprise
Google “Nano Banana 2”陷生成质量争议,Reddit用户称画面趋于平淡
-
AI & Enterprise
Kakao升级Kanana-o语音生成功能:自然语言可直接控制语气情绪
-
AI & Enterprise
韩国“独立AI基础模型”项目进入二次评估:LG与SKT押注600B级,Upstage和Motif主打效率
-
Crypto
Coinbase与Strike回应资金分流质疑:比特币难言遭遇结构性冲击
-
AI & Enterprise
Google发布“Nano Banana 2 Lite”图像生成模型:成本减半,生成速度最高提升2.7倍
-
AI & Enterprise
SoftBank、Meta入局Neocloud,AI云市场冲击AWS等三巨头格局
-
AI & Enterprise
DeepSeek开源DSpark:推理提速最高85%,吞吐量最高提升661%
-
AI & Enterprise
xAI上线Grok Imagine Video 1.5 Fast,6秒720p视频最快25秒生成
-
AI & Enterprise
Datadog在DASH 2026扩展Bits AI,推进开发、安全与运维自动化
-
AI & Enterprise
NVIDIA发布5500亿参数开源大模型Nemotron 3 Ultra,Vera Rubin平台进入量产阶段
-
AI & Enterprise
AI代码工具普及加深依赖:开发者体感提效,实测却未必更快
-
AI & Enterprise
Prism ML发布Bonsai Image 4B:iPhone端侧出图约12秒
-
AI & Enterprise
Microsoft推出自研图像生成模型MAI-Image-2.5,Arena文生图评测列全球第3