英伟达 标签,匹配到约1280个结果, 耗时0.0235秒
全球Token「印钞流水线」大升级,幕后推手Agentic Infra首次曝光!
全球Token「印钞流水线」大升级,幕后推手Agentic Infra首次曝光!...
2026-07-20
·
浏览17次
(更新:马斯克否认)鸿海首度夺下 SpaceX AI 服务器代工订单,总价高达 520 亿美元
鸿海首次获得 SpaceX 的 AI 服务器代工订单,价值高达 520 亿美元,将打破戴尔、超微的长期垄断。订单涉及超 1.3 万个英伟达 GB300 服务器机柜,预计今年四季度开始交付。#鸿海# #SpaceX# #AI服务器#...
2026-07-20
·
浏览45次
鸿海首度夺下 SpaceX AI 服务器代工订单,总价高达 520 亿美元
鸿海首次获得 SpaceX 的 AI 服务器代工订单,价值高达 520 亿美元,将打破戴尔、超微的长期垄断。订单涉及超 1.3 万个英伟达 GB300 服务器机柜,预计今年四季度开始交付。#鸿海# #SpaceX# #AI服务器#...
2026-07-20
·
浏览40次
面壁智能发布端侧模型 MiniCPM5-2B,AA-Index 榜单 4B 以下性能第一
面壁智能今日联合 OpenBMB 发布了最新端侧模型 MiniCPM5-2B,并完成多款芯片适配。...
2026-07-19
·
浏览52次
英伟达发布 Nemotron 3 Embed 系列 AI 模型,8B 版斩获 RTEB 榜首
英伟达昨日(7 月 17 日)发布博文,宣布开源推出 Nemotron 3 Embed 系列模型,主要面向 AI 智能体和检索增强生成(RAG)场景。...
2026-07-18
·
浏览46次
NVIDIA 联手日本政经界发布全球首个国家级人工智能基础设施
这座 140MW 国家物理 AI 工厂将部署 13750 块 Vera CPU 和 27500 块 Rubin GPU,支持 T 级模型训练。...
2026-07-16
·
浏览79次
英伟达与三菱重工拟在 AI 数据中心领域展开合作,将冷却与能源管理技术融入下一代 AI 数据中心
据报道,英伟达正考虑与三菱重工在 AI 数据中心技术领域合作,计划将后者的冷却系统和能源管理技术融入英伟达的下一代数据中心。英伟达将其定位为“人工智能工厂”,而三菱重工也在开发专为 AI 设计的数据中心“DIAVAULT”及液冷系统。 #A...
2026-07-14
·
浏览108次
挑战英伟达主导细分市场:消息称谷歌向 Neocloud 推销 TPU
谷歌曾与多家 Neocloud 企业就部署 TPU 一事进行了讨论,还提议回租 TPU 云服务。...
2026-07-14
·
浏览75次
每秒 520 万亿次浮点运算,我国自研 AI 芯片取得架构突破
我国首颗采用软件定义与三维近存计算技术的 AI 芯片亮相,通过底层架构创新,在 14 纳米制程上实现每秒 520 万亿次浮点运算,有效缓解“存储墙”瓶颈,并形成从加速卡到大规模智算集群的完整产品体系。这为人工智能算力底座提供了自主可控的新路...
2026-07-13
·
浏览155次
芯片板块剧烈波动,业内多位高管称 AI 需求依然强劲
近期芯片股波动引发 AI 需求是否降温的讨论。多位 AI 行业高管表示,整体需求依然旺盛,供给严重跟不上,特别是数据中心和芯片。同时,企业正从“不计成本”转向关注投资回报,进入更理性的 AI 部署阶段。#AI芯片##算力需求#...
2026-07-13
·
浏览99次
AI 推理测试:英特尔 Arc Pro B70 显卡吞吐最高 2320.76 token/s,超英伟达 RTX 5090D
科技媒体 Wccftech 昨日(7 月 8 日)发布博文,报道称显卡厂商蓝戟(GUNNIR)测试英特尔 Arc Pro B70 GPU,在 DeepSeek R1 模型表现上超过英伟达的 RTX 5090D 和 RTX 4090D 显卡。...
2026-07-09
·
浏览108次
DeepSeek R1 推理测试:英特尔 Arc Pro B70 显卡吞吐最高 2320.76 token/s
科技媒体 Wccftech 昨日(7 月 8 日)发布博文,报道称显卡厂商蓝戟(GUNNIR)测试英特尔 Arc Pro B70 GPU,在 DeepSeek R1 模型表现上超过英伟达的 RTX 5090D 和 RTX 4090D 显卡。...
2026-07-09
·
浏览103次
推理成本仅为顶级闭源模型的 1/10:英伟达 Nemotron 3 Ultra 获开源模型最高准确率
LangChain 为 NVIDIA Nemotron 3 Ultra 调整 Deep Agents 框架后,在基准测试中取得领先性能,推理成本仅为顶级闭源模型的十分之一,且无需重新训练模型。...
2026-07-09
·
浏览115次
20+ 构型泛化、多自由度支持,蚂蚁灵波开源新一代具身基座模型 LingBot-VLA 2.0
蚂蚁灵波科技正式开源 LingBot-VLA 2.0 具身基座模型。相比年初的 1.0 版本,新模型基于 6 万小时高质量真机与人类操作数据训练,支持 17 个主流品牌 20 种机器人构型,在双臂协同与移动操作任务上表现领先。推理效率大幅提...
2026-07-08
·
浏览126次
AI 芯片竞合并存:NVIDIA 牵手 d-Matrix 打造混合算力基础设施
Neocloud 企业 Parasail 通过将 NVIDIA 的 Hopper / Blackwell GPU 与 d-Matrix 的 Corsair ASIC 相结合,实现了 10 倍的 Token 生成速率。...
2026-07-08
·
浏览118次
英伟达发布 Audex 统一模型:30B 总参数,避免多模态扩展后文本能力下滑问题
英伟达于今年 6 月发表论文,推出 Audex(Nemotron-Labs-Audex-30B-A3B)统一音频-文本大语言模型,总参数量 30B,激活参数 3B,支持音频输入与音频输出。...
2026-07-08
·
浏览110次
消息称 DeepSeek 正在自研 AI 芯片:面向推理场景,减少依赖英伟达、华为
据路透社报道,AI 初创公司 DeepSeek 正在研发面向推理场景的自有 AI 芯片,旨在降低对英伟达和华为的依赖。该项目已启动约一年,目前处于早期阶段,正与设计、制造及存储厂商洽谈。消息引发英伟达盘前股价下跌约 1.6%。#DeepSe...
2026-07-08
·
浏览108次
可规模化单线程最强 CPU:英伟达 Vera 在智能体 AI 负载下持续性能是 x86 的 1.8 倍
英伟达昨日(7 月 7 日)发布博文,指出在智能体 AI 时代,NVIDIA Vera CPU 成为“可规模化最大单线程 CPU”,持续单核性能是 x86 的 1.8 倍。...
2026-07-08
·
浏览110次
AI 中文社