测试 标签,匹配到约3908个结果, 耗时0.0422秒
突发!OpenAI下一代AI攻克10项菲尔兹奖级难题

突发!OpenAI下一代AI攻克10项菲尔兹奖级难题

突发!OpenAI下一代AI攻克10项菲尔兹奖级难题
突发!OpenAI下一代AI攻克10项菲尔兹奖级难题...
2026-08-02 · 浏览3次
从11.9%飙到95.95%!微软屠榜网安基准,真正王牌不是大模型

从11.9%飙到95.95%!微软屠榜网安基准,真正王牌不是大模型

从11.9%飙到95.95%!微软屠榜网安基准,真正王牌不是大模型
从11.9%飙到95.95%!微软屠榜网安基准,真正王牌不是大模型...
2026-08-02 · 浏览2次
因使用月之暗面模型写代码,美国最大外卖平台 DoorDash 被议员调查

因使用月之暗面模型写代码,美国最大外卖平台 DoorDash 被议员调查

因使用月之暗面模型写代码,美国最大外卖平台 DoorDash 被议员调查
美国外卖巨头 DoorDash 因使用中国 AI 公司月之暗面的 Kimi K2.6 模型,遭到众议院两个委员会联合调查。公司创始人称该模型组合性能更强、成本更低,但议员们担忧其存在安全风险。#中美AI竞争# 双方正就此事展开沟通。...
2026-08-02 · 浏览7次
珍稀图书遭粉碎用于 AI 训练引众怒,图书数据库 ISBNdb 下架 AI 相关测试页面

珍稀图书遭粉碎用于 AI 训练引众怒,图书数据库 ISBNdb 下架 AI 相关测试页面

珍稀图书遭粉碎用于 AI 训练引众怒,图书数据库 ISBNdb 下架 AI 相关测试页面
AI 公司为获取高质量训练数据,大量采购实体图书并销毁,这一做法引发广泛争议。图书供应商接到巨额订单,业内人士猜测幕后买家为 AI 公司,而数据库网站 ISBNdb 被指在其中牵线搭桥。尽管该公司已删除相关宣传并否认,但类似“巴拿马计划”项...
2026-08-02 · 浏览10次
一夜之间,Anthropic内部都在搞「智能体图」!

一夜之间,Anthropic内部都在搞「智能体图」!

一夜之间,Anthropic内部都在搞「智能体图」!
一夜之间,Anthropic内部都在搞「智能体图」!...
2026-08-01 · 浏览17次
一夜之间,Anthropic内部都在搞「智能体图」!

一夜之间,Anthropic内部都在搞「智能体图」!

一夜之间,Anthropic内部都在搞「智能体图」!
一夜之间,Anthropic内部都在搞「智能体图」!...
2026-08-01 · 浏览38次
成为父亲后,奥特曼不再害怕AGI毁灭世界

成为父亲后,奥特曼不再害怕AGI毁灭世界

成为父亲后,奥特曼不再害怕AGI毁灭世界
成为父亲后,奥特曼不再害怕AGI毁灭世界...
2026-08-01 · 浏览35次
爱奇艺宣布 10 部 AIGC 电影进入成片制作阶段,奥斯卡最佳摄影得主鲍德熹负责指导

爱奇艺宣布 10 部 AIGC 电影进入成片制作阶段,奥斯卡最佳摄影得主鲍德熹负责指导

爱奇艺宣布 10 部 AIGC 电影进入成片制作阶段,奥斯卡最佳摄影得主鲍德熹负责指导
爱奇艺 7 月 31 日宣布,“鲍德熹 · 爱奇艺电影剧场”正式公布最终晋级名单,10 部题材各异的 AIGC 华语商业电影项目从路演中脱颖而出,正式进入开发阶段。...
2026-08-01 · 浏览39次
OpenAI全球用户破10亿!全新模型Astra曝光,疑似GPT-6

OpenAI全球用户破10亿!全新模型Astra曝光,疑似GPT-6

OpenAI全球用户破10亿!全新模型Astra曝光,疑似GPT-6
OpenAI全球用户破10亿!全新模型Astra曝光,疑似GPT-6...
2026-08-01 · 浏览43次
硅谷百亿美金押注「AI造AI」,清华系创业团队反手把模型开源了!

硅谷百亿美金押注「AI造AI」,清华系创业团队反手把模型开源了!

硅谷百亿美金押注「AI造AI」,清华系创业团队反手把模型开源了!
硅谷百亿美金押注「AI造AI」,清华系创业团队反手把模型开源了!...
2026-08-01 · 浏览50次
DeepSeek-V4-Flash 正式版跑分报告:AI 单任务成本比 GPT-5.6 Luna 低约 60%

DeepSeek-V4-Flash 正式版跑分报告:AI 单任务成本比 GPT-5.6 Luna 低约 60%

DeepSeek-V4-Flash 正式版跑分报告:AI 单任务成本比 GPT-5.6 Luna 低约 60%
深度求索(DeepSeek)昨日(7 月 31 日)通过 API 文档发布日志,宣布 DeepSeek-V4-Flash 正式版 API 上线公测。@ArtificialAnlys、@arena 等 AI 跑分基准平台今天(8 月 1 日)...
2026-08-01 · 浏览62次
突发,谷歌地球紧急撤回Nano Banana 2生图功能!

突发,谷歌地球紧急撤回Nano Banana 2生图功能!

突发,谷歌地球紧急撤回Nano Banana 2生图功能!
突发,谷歌地球紧急撤回Nano Banana 2生图功能!...
2026-08-01 · 浏览63次
Claude黑进三家真公司!Anthropic吓坏了

Claude黑进三家真公司!Anthropic吓坏了

Claude黑进三家真公司!Anthropic吓坏了
Claude黑进三家真公司!Anthropic吓坏了...
2026-08-01 · 浏览37次
AI能接管实验室了?中国科大最新研究给出真实物理世界的压力测试

AI能接管实验室了?中国科大最新研究给出真实物理世界的压力测试

AI能接管实验室了?中国科大最新研究给出真实物理世界的压力测试
AI能接管实验室了?中国科大最新研究给出真实物理世界的压力测试...
2026-07-31 · 浏览33次
AI能接管实验室了?中国科大最新研究给出真实物理世界的压力测试

AI能接管实验室了?中国科大最新研究给出真实物理世界的压力测试

AI能接管实验室了?中国科大最新研究给出真实物理世界的压力测试
AI能接管实验室了?中国科大最新研究给出真实物理世界的压力测试...
2026-07-31 · 浏览50次
刚刚,DeepSeek V4正式版来了!

刚刚,DeepSeek V4正式版来了!

刚刚,DeepSeek V4正式版来了!
刚刚,DeepSeek V4正式版来了!...
2026-07-31 · 浏览61次
“小号”美国最强开源模型:Inkling-Small 登场,约 1/4 规模提供相近 AI 性能

“小号”美国最强开源模型:Inkling-Small 登场,约 1/4 规模提供相近 AI 性能

“小号”美国最强开源模型:Inkling-Small 登场,约 1/4 规模提供相近 AI 性能
Thinking Machines Lab 昨日(7 月 30 日)发布博文,宣布推出 Inkling-Small 模型,其性能媲美 Inkling,但规模降低至约四分之一。...
2026-07-31 · 浏览47次
最严苛 AI 交互推理测试:OpenAI 两项改进让 GPT-5.6 Sol 提分 188%

最严苛 AI 交互推理测试:OpenAI 两项改进让 GPT-5.6 Sol 提分 188%

最严苛 AI 交互推理测试:OpenAI 两项改进让 GPT-5.6 Sol 提分 188%
ARC Prize  ARC 奖  ARC 奖  ARC 奖团队推出的全新交互式推理基准测试,旨在衡量人工智能代理(AI Agent)在未知和动态环境中的类似人类的智能与技能获取效率...
2026-07-31 · 浏览47次
谷歌最新 AI 大模型 Gemini 3.5 Pro 短暂上线 Arena 竞技场,已延迟数月

谷歌最新 AI 大模型 Gemini 3.5 Pro 短暂上线 Arena 竞技场,已延迟数月

谷歌最新 AI 大模型 Gemini 3.5 Pro 短暂上线 Arena 竞技场,已延迟数月
据多位用户反馈,鸽了许久的谷歌 Gemini 3.5 Pro 大模型今日短暂现身 AI 盲测平台 Arena,上线仅 30 分钟便被撤下。该模型原定于 6 月推出,但多次跳票。#谷歌AI# 此次短暂露面,暗示测试可能已进入最后阶段。...
2026-07-31 · 浏览46次
消息称阿里千问模型已在特斯拉车机内测,号称能听能答、能控车、能导航

消息称阿里千问模型已在特斯拉车机内测,号称能听能答、能控车、能导航

消息称阿里千问模型已在特斯拉车机内测,号称能听能答、能控车、能导航
消息称阿里千问模型已在特斯拉车机内测,目前已在真实车机环境完成大量测试,可支持语义理解、控车导航等能力,已有多家国内头部车企宣布接入该模型。#阿里千问大模型#...
2026-07-31 · 浏览42次
DeepSeek-V4-Flash 正式版 API 上线公测,V4-Pro 正式版将“尽快”发布

DeepSeek-V4-Flash 正式版 API 上线公测,V4-Pro 正式版将“尽快”发布

DeepSeek-V4-Flash 正式版 API 上线公测,V4-Pro 正式版将“尽快”发布
今天(31 日)下午,DeepSeek 通过 API 文档发布日志,宣布 DeepSeek-V4-Flash 正式版 API 上线公测。...
2026-07-31 · 浏览91次
韩国最大人工智能基础模型:LG AI 研究院发布 750B 参数 K-EXAONE 2.0

韩国最大人工智能基础模型:LG AI 研究院发布 750B 参数 K-EXAONE 2.0

韩国最大人工智能基础模型:LG AI 研究院发布 750B 参数 K-EXAONE 2.0
K-EXAONE 2.0 采用混合注意力 MoE 架构,拥有 750B 总参数和 37B 激活参数,规模是 236B-A23B 的初代 K-EXAONE 的 3 倍以上。...
2026-07-31 · 浏览63次
翁荔刚回OpenAI,Thinking Machines反手甩出新模型

翁荔刚回OpenAI,Thinking Machines反手甩出新模型

翁荔刚回OpenAI,Thinking Machines反手甩出新模型
翁荔刚回OpenAI,Thinking Machines反手甩出新模型...
2026-07-31 · 浏览47次
Anthropic:第三方评估环境配置失误,导致三起真实网络安全事件

Anthropic:第三方评估环境配置失误,导致三起真实网络安全事件

Anthropic:第三方评估环境配置失误,导致三起真实网络安全事件
这三次事件中 Anthropic 的模型都被指派了无限制的“夺旗”网络攻击任务。此类任务的测试环境需与真实互联网隔离,但错误配置导致模型实际上拥有真实互联网访问权限。...
2026-07-31 · 浏览47次
第一页 · 上一页 · 下一页 · 当前第1页