测试 标签,匹配到约4123个结果, 耗时0.0542秒
2026 中国电信研究院 AITMark 奖项出炉,华为小艺获 AI 手机智能体综合评分第一
华为官方今日宣布,2026 中国电信研究院 AITMark 奖项出炉,小艺获 AI 手机智能体综合评分第一。同时,#华为PuraXMax#获旗舰手机场景智能评测综合评分第一,影像、办公等各场景智能评分均第一。...
2026-08-26
·
浏览10次
Artificial Analysis 公布苹果 iPhone 17 Pro 跑 8GB 以内本地 AI 性能排名
Artificial Analysis 于 8 月 24 日发布博文,宣布携手 Liquid AI,发布面向手机端的 AI 跑分基准,重点关注 AI 模型在苹果 iPhone 17 Pro 上的表现。...
2026-08-26
·
浏览25次
OpenAI 首款自研芯片 Jalapeño 性能首秀:DeepSeek R1 每瓦 AI 吞吐量是 GB300 的 1.7 倍
测试显示这款芯片每瓦 AI 工作量是英伟达 GB200/GB300 的 1.5 至 1.9 倍,端到端延迟仅为对手的 28% 至 59%,能效表现十分出色。#OpenAI自研芯片#...
2026-08-26
·
浏览40次
OpenAI 秀肌肉,与博通共研的 Jalapeño 芯片将向英伟达 GB300 发起挑战
在 SemiAnalysis 的 InferenceX 测试中,Jalapeño 无论是单用户 token 处理量,还是每千瓦吞吐量,都超过了目前市面上的顶尖推理处理器。...
2026-08-25
·
浏览34次
Vera Rubin公布真实测试成绩:吞吐量最高飙升了30倍、Token成本最高暴降了35倍
在AgentX工作负载下,搭配DeepSeek-V4-Pro(1.6万亿参数)模型进行实测,Vera Rubin NVL72的每兆瓦吞吐量比上一代主力机皇GB300 NVL72最高提升了整整30倍。与此同时,生产每百万Token的成本最高降...
2026-08-25
·
浏览50次
DeepSeek-V4-PRO AI 模型测试:英伟达 Vera Rubin 每兆瓦吞吐量达 GB300 的 30 倍
英伟达公布 Vera Rubin NVL72 系统在智能体 AI workloads 上每兆瓦吞吐量较 GB300 NVL72 最高提升 30x,token 成本最高降低 35x ,介绍了其架构设计与性能优势 Vera Rubin 单位功耗...
2026-08-25
·
浏览44次
字节跳动发布“豆包工作”,与飞书深度打通
字节跳动今日正式发布“豆包工作”。作为豆包面向生产力场景推出的全新 Agent 产品与品牌,豆包工作能围绕用户目标自主拆解任务、调用工具、持续推进复杂工作流程。...
2026-08-25
·
浏览61次
高盛合伙人警告:华尔街普及 AI 或削弱金融从业者思考能力
高盛 AI 项目负责人称,AI 接管初级从业者日常工作后,从业者会将推理能力外包,逐渐丧失分析能力,还会冲击传统师徒培养体系,目前高盛也还没理清转型管理方向#AI与金融行业#...
2026-08-25
·
浏览41次
美国阿拉巴马州向 OpenAI 发出传票,就其模型入侵 Hugging Face 事件展开调查
OpenAI 一款网络安全模型在测试中脱离隔离环境,入侵了 Hugging Face 等平台。阿拉巴马州总检察长已发出传票,调查其产品安全是否违反消费者保护法。AI 安全再次引发关注。#OpenAI安全事件#...
2026-08-25
·
浏览46次
卡迪夫大学新研究:AI 尚无法像人类教师一样可靠地批改作业
除一种情况外,AI 模型给出的平均分普遍高于人工评分。平均分方面,AI 模型与人工评分的最大差距达到 16.1 分;具体到单篇论文,最大差距达到 40 分。...
2026-08-24
·
浏览42次
路透社母公司汤森路透花 4000 万美元研发 AI 模型,基于阿里千问
汤森路透发布首款大语言模型 Thomson,基于阿里千问 Qwen3.5-397B,研发成本约 4000 万美元。该模型在多项法律基准测试中表现优异,强调自研模型在成本控制和定制化上的优势。#AI大模型#...
2026-08-24
·
浏览61次
AI 大模型周榜:国产 glm-5.3-max 首秀闯入综合榜前 15,kimi-k3-max 冲进前十
本周 Arena 榜单中,智谱 glm-5.3-max 首次入榜位列综合榜第 13 名,月之暗面 kimi-k3-max 升至综合榜第 10 名。...
2026-08-24
·
浏览78次
AI 中文社