测试 标签,匹配到约3895个结果, 耗时0.0217秒
AI能接管实验室了?中国科大最新研究给出真实物理世界的压力测试

AI能接管实验室了?中国科大最新研究给出真实物理世界的压力测试

AI能接管实验室了?中国科大最新研究给出真实物理世界的压力测试
AI能接管实验室了?中国科大最新研究给出真实物理世界的压力测试...
2026-07-31 · 浏览17次
AI能接管实验室了?中国科大最新研究给出真实物理世界的压力测试

AI能接管实验室了?中国科大最新研究给出真实物理世界的压力测试

AI能接管实验室了?中国科大最新研究给出真实物理世界的压力测试
AI能接管实验室了?中国科大最新研究给出真实物理世界的压力测试...
2026-07-31 · 浏览32次
刚刚,DeepSeek V4正式版来了!

刚刚,DeepSeek V4正式版来了!

刚刚,DeepSeek V4正式版来了!
刚刚,DeepSeek V4正式版来了!...
2026-07-31 · 浏览38次
“小号”美国最强开源模型:Inkling-Small 登场,约 1/4 规模提供相近 AI 性能

“小号”美国最强开源模型:Inkling-Small 登场,约 1/4 规模提供相近 AI 性能

“小号”美国最强开源模型:Inkling-Small 登场,约 1/4 规模提供相近 AI 性能
Thinking Machines Lab 昨日(7 月 30 日)发布博文,宣布推出 Inkling-Small 模型,其性能媲美 Inkling,但规模降低至约四分之一。...
2026-07-31 · 浏览33次
最严苛 AI 交互推理测试:OpenAI 两项改进让 GPT-5.6 Sol 提分 188%

最严苛 AI 交互推理测试:OpenAI 两项改进让 GPT-5.6 Sol 提分 188%

最严苛 AI 交互推理测试:OpenAI 两项改进让 GPT-5.6 Sol 提分 188%
ARC Prize  ARC 奖  ARC 奖  ARC 奖团队推出的全新交互式推理基准测试,旨在衡量人工智能代理(AI Agent)在未知和动态环境中的类似人类的智能与技能获取效率...
2026-07-31 · 浏览31次
谷歌最新 AI 大模型 Gemini 3.5 Pro 短暂上线 Arena 竞技场,已延迟数月

谷歌最新 AI 大模型 Gemini 3.5 Pro 短暂上线 Arena 竞技场,已延迟数月

谷歌最新 AI 大模型 Gemini 3.5 Pro 短暂上线 Arena 竞技场,已延迟数月
据多位用户反馈,鸽了许久的谷歌 Gemini 3.5 Pro 大模型今日短暂现身 AI 盲测平台 Arena,上线仅 30 分钟便被撤下。该模型原定于 6 月推出,但多次跳票。#谷歌AI# 此次短暂露面,暗示测试可能已进入最后阶段。...
2026-07-31 · 浏览34次
消息称阿里千问模型已在特斯拉车机内测,号称能听能答、能控车、能导航

消息称阿里千问模型已在特斯拉车机内测,号称能听能答、能控车、能导航

消息称阿里千问模型已在特斯拉车机内测,号称能听能答、能控车、能导航
消息称阿里千问模型已在特斯拉车机内测,目前已在真实车机环境完成大量测试,可支持语义理解、控车导航等能力,已有多家国内头部车企宣布接入该模型。#阿里千问大模型#...
2026-07-31 · 浏览31次
DeepSeek-V4-Flash 正式版 API 上线公测,V4-Pro 正式版将“尽快”发布

DeepSeek-V4-Flash 正式版 API 上线公测,V4-Pro 正式版将“尽快”发布

DeepSeek-V4-Flash 正式版 API 上线公测,V4-Pro 正式版将“尽快”发布
今天(31 日)下午,DeepSeek 通过 API 文档发布日志,宣布 DeepSeek-V4-Flash 正式版 API 上线公测。...
2026-07-31 · 浏览76次
韩国最大人工智能基础模型:LG AI 研究院发布 750B 参数 K-EXAONE 2.0

韩国最大人工智能基础模型:LG AI 研究院发布 750B 参数 K-EXAONE 2.0

韩国最大人工智能基础模型:LG AI 研究院发布 750B 参数 K-EXAONE 2.0
K-EXAONE 2.0 采用混合注意力 MoE 架构,拥有 750B 总参数和 37B 激活参数,规模是 236B-A23B 的初代 K-EXAONE 的 3 倍以上。...
2026-07-31 · 浏览41次
翁荔刚回OpenAI,Thinking Machines反手甩出新模型

翁荔刚回OpenAI,Thinking Machines反手甩出新模型

翁荔刚回OpenAI,Thinking Machines反手甩出新模型
翁荔刚回OpenAI,Thinking Machines反手甩出新模型...
2026-07-31 · 浏览33次
Anthropic:第三方评估环境配置失误,导致三起真实网络安全事件

Anthropic:第三方评估环境配置失误,导致三起真实网络安全事件

Anthropic:第三方评估环境配置失误,导致三起真实网络安全事件
这三次事件中 Anthropic 的模型都被指派了无限制的“夺旗”网络攻击任务。此类任务的测试环境需与真实互联网隔离,但错误配置导致模型实际上拥有真实互联网访问权限。...
2026-07-31 · 浏览34次
新研究:AI 对就业市场的真正威胁不是失业,而是让加薪更困难

新研究:AI 对就业市场的真正威胁不是失业,而是让加薪更困难

新研究:AI 对就业市场的真正威胁不是失业,而是让加薪更困难
最新研究显示,AI 暂未对整体就业产生可检测影响,但会显著压低工资增速,低收入劳动者受冲击最明显,未来或将进一步加剧收入不平等。...
2026-07-31 · 浏览31次
GPT-5.6一夜爆砍80%,1元屠杀最贵Claude!

GPT-5.6一夜爆砍80%,1元屠杀最贵Claude!

GPT-5.6一夜爆砍80%,1元屠杀最贵Claude!
GPT-5.6一夜爆砍80%,1元屠杀最贵Claude!...
2026-07-31 · 浏览49次
ChatGPT突发封杀令!全球AI写手一夜断粮

ChatGPT突发封杀令!全球AI写手一夜断粮

ChatGPT突发封杀令!全球AI写手一夜断粮
ChatGPT突发封杀令!全球AI写手一夜断粮...
2026-07-31 · 浏览55次
Meta 借助 AI 大幅缩短应用开发周期,更多新应用已在路上

Meta 借助 AI 大幅缩短应用开发周期,更多新应用已在路上

Meta 借助 AI 大幅缩短应用开发周期,更多新应用已在路上
近期推出的产品包括面向 Marketplace 卖家的应用、Facebook 群组应用、通过“氛围编程”打造的游戏应用、Instagram 照片应用,以及 AI 睡前故事实验。...
2026-07-31 · 浏览37次
研究显示:AI 聊天机器人实施情感诈骗的能力已超越人类

研究显示:AI 聊天机器人实施情感诈骗的能力已超越人类

研究显示:AI 聊天机器人实施情感诈骗的能力已超越人类
四所大学联合研究测试发现,AI 聊天机器人在恋爱诈骗这类“长期骗局”中,获取受害者信任的效果远超人类,同意诈骗请求的比例接近一半。#AI诈骗#...
2026-07-30 · 浏览54次
马斯克:Grok 4.6 将于 8 月 7 日发布,几周后推出 2.1 万亿参数 Grok 4.7

马斯克:Grok 4.6 将于 8 月 7 日发布,几周后推出 2.1 万亿参数 Grok 4.7

马斯克:Grok 4.6 将于 8 月 7 日发布,几周后推出 2.1 万亿参数 Grok 4.7
马斯克透露 Grok 4.6 和 Grok 4.7 的发布计划,两款模型参数分别达 1.5 万亿、2.1 万亿,将在性能方面获得显著提升。#Grok大模型#...
2026-07-30 · 浏览51次
AI开始给自己写代码了!GPT-5.6重写内核,服务成本直降20%

AI开始给自己写代码了!GPT-5.6重写内核,服务成本直降20%

AI开始给自己写代码了!GPT-5.6重写内核,服务成本直降20%
AI开始给自己写代码了!GPT-5.6重写内核,服务成本直降20%...
2026-07-30 · 浏览55次
马斯克旗下 SpaceXAI 最智能 AI 语音模型,Grok Voice Think Fast 2.0 登场

马斯克旗下 SpaceXAI 最智能 AI 语音模型,Grok Voice Think Fast 2.0 登场

马斯克旗下 SpaceXAI 最智能 AI 语音模型,Grok Voice Think Fast 2.0 登场
埃隆 · 马斯克(Elon Musk)旗下 SpaceXAI 公司昨日(7 月 29 日)发布 Grok Voice Think Fast 2.0,是其功能最强大、最智能的语音对语音(speech-to-speech) AI 模型。...
2026-07-30 · 浏览46次
OpenAI 部署 GPT-5.6 优化模型自身推理性能,端到端服务成本最多降低 20%

OpenAI 部署 GPT-5.6 优化模型自身推理性能,端到端服务成本最多降低 20%

OpenAI 部署 GPT-5.6 优化模型自身推理性能,端到端服务成本最多降低 20%
OpenAI 公司昨日(7 月 29 日)发布博文,宣布通过 GPT-5.6 Sol 模型,来优化 GPT-5.6 系列模型本身 AI 推理链路,端到端服务成本最多降低 20%。...
2026-07-30 · 浏览43次
奥特曼都惊了!一句话调500个Agent,一个人顶一家公司

奥特曼都惊了!一句话调500个Agent,一个人顶一家公司

奥特曼都惊了!一句话调500个Agent,一个人顶一家公司
奥特曼都惊了!一句话调500个Agent,一个人顶一家公司...
2026-07-30 · 浏览46次
突发!北大校友翁荔入职OpenAI

突发!北大校友翁荔入职OpenAI

突发!北大校友翁荔入职OpenAI
突发!北大校友翁荔入职OpenAI...
2026-07-30 · 浏览86次
谷歌旗下 Wiz 公布漏洞挖掘系统 Atlas:利用多个 AI 智能体分工协作、已发现超 200 个漏洞

谷歌旗下 Wiz 公布漏洞挖掘系统 Atlas:利用多个 AI 智能体分工协作、已发现超 200 个漏洞

谷歌旗下 Wiz 公布漏洞挖掘系统 Atlas:利用多个 AI 智能体分工协作、已发现超 200 个漏洞
谷歌旗下 Wiz 发布 AI 智能体系统 Atlas,它像人类安全团队一样分工协作,以多阶段、程序化方式自主挖掘软件漏洞。系统已在实际应用中检测出超 200 个此前未知的安全漏洞,并因此获得 GitHub 10 万美元奖金。#AI安全# #...
2026-07-29 · 浏览53次
刚刚,Agnes国内API节点来了!这头撸代码的AI怪兽彻底解禁

刚刚,Agnes国内API节点来了!这头撸代码的AI怪兽彻底解禁

刚刚,Agnes国内API节点来了!这头撸代码的AI怪兽彻底解禁
刚刚,Agnes国内API节点来了!这头撸代码的AI怪兽彻底解禁...
2026-07-29 · 浏览72次
第一页 · 上一页 · 下一页 · 当前第1页