以前搞企业 AI: 砸钱堆 GPU,满脑子算力狂飙。 一跑业务全懵 —— 网先卡、终端掉,升级贵,算力空转白忙活。
“总体而言,我们在AI服务器上的投资回报周期不到两年。而使用我们自研芯片,其回报周期是GPU的一半。”谷歌云(Google Cloud)首席执行官 Thomas Kurian 表示。
无服务器AI让企业通过API调用基础模型,省去GPU选型与扩缩容烦恼;但按量计费对稳态推理负载反而更贵,且冷启动、延迟、实例不可控等短板难以抵消。季节性/不可预测流量是理想场景,稳态推理则不适合。
随着客户需求的加速增长,双方深化了在整个 AI 技术栈的整合,将 NVIDIA Vera CPU、高性能网络、Nemotron 开放模型和物理 AI 技术引入亚马逊云科技。
SpaceX IPO文件披露xAI向竞争对手Anthropic提供每月12.5亿美元算力服务,标志着AI算力正在从内部能力演变为独立的可交易战略资产,类似于云计算市场的商业化模式。
GPU巨头预测今年CPU营收将达到200亿美元。
绝大多数号称安全的密码哈希值,用单块显卡在不到一小时内就能被破解,有些甚至不到一分钟。
现已开启预览,DeepSeek V4 将推理成本降至 R1 的一小部分。
英伟达推出基于Groq的新一代推理服务器机架——Nvidia Groq 3 LPX,将于今年下半年与 Vera Rubin NVL72 机架、Vera CPU 机架以及 BlueField-4 STX 存储机架一同上市。
《华尔街日报》称,英伟达正在研发一款专用的推理处理器。这款芯片将被OpenAI集团及其他人工智能公司用于开发更快、更高效的AI模型。
9月24日 数智远航:数据治理 全球协同
9月15日 亚马逊全球开店——2026全球领航者创想营
9月10日 数智远航:智能算力 无界全球
9月9日 当勒索攻击瞄准备份环境,企业如何确保业务持续运行
9月8日 构建 “虚拟天空”:空间数据与数字仿真如何重塑低空飞行?
8月27日 数智远航:全球智造 敏捷交付
中小企业IT网
电脑商情在线
ToB最前沿
抖音扫码
ToB最前沿抖音号
CBI科技在线