测试 标签,匹配到约3908个结果, 耗时0.0422秒
因使用月之暗面模型写代码,美国最大外卖平台 DoorDash 被议员调查
美国外卖巨头 DoorDash 因使用中国 AI 公司月之暗面的 Kimi K2.6 模型,遭到众议院两个委员会联合调查。公司创始人称该模型组合性能更强、成本更低,但议员们担忧其存在安全风险。#中美AI竞争# 双方正就此事展开沟通。...
2026-08-02
·
浏览7次
珍稀图书遭粉碎用于 AI 训练引众怒,图书数据库 ISBNdb 下架 AI 相关测试页面
AI 公司为获取高质量训练数据,大量采购实体图书并销毁,这一做法引发广泛争议。图书供应商接到巨额订单,业内人士猜测幕后买家为 AI 公司,而数据库网站 ISBNdb 被指在其中牵线搭桥。尽管该公司已删除相关宣传并否认,但类似“巴拿马计划”项...
2026-08-02
·
浏览10次
爱奇艺宣布 10 部 AIGC 电影进入成片制作阶段,奥斯卡最佳摄影得主鲍德熹负责指导
爱奇艺 7 月 31 日宣布,“鲍德熹 · 爱奇艺电影剧场”正式公布最终晋级名单,10 部题材各异的 AIGC 华语商业电影项目从路演中脱颖而出,正式进入开发阶段。...
2026-08-01
·
浏览39次
DeepSeek-V4-Flash 正式版跑分报告:AI 单任务成本比 GPT-5.6 Luna 低约 60%
深度求索(DeepSeek)昨日(7 月 31 日)通过 API 文档发布日志,宣布 DeepSeek-V4-Flash 正式版 API 上线公测。@ArtificialAnlys、@arena 等 AI 跑分基准平台今天(8 月 1 日)...
2026-08-01
·
浏览62次
“小号”美国最强开源模型:Inkling-Small 登场,约 1/4 规模提供相近 AI 性能
Thinking Machines Lab 昨日(7 月 30 日)发布博文,宣布推出 Inkling-Small 模型,其性能媲美 Inkling,但规模降低至约四分之一。...
2026-07-31
·
浏览47次
最严苛 AI 交互推理测试:OpenAI 两项改进让 GPT-5.6 Sol 提分 188%
ARC Prize ARC 奖 ARC 奖 ARC 奖团队推出的全新交互式推理基准测试,旨在衡量人工智能代理(AI Agent)在未知和动态环境中的类似人类的智能与技能获取效率...
2026-07-31
·
浏览47次
谷歌最新 AI 大模型 Gemini 3.5 Pro 短暂上线 Arena 竞技场,已延迟数月
据多位用户反馈,鸽了许久的谷歌 Gemini 3.5 Pro 大模型今日短暂现身 AI 盲测平台 Arena,上线仅 30 分钟便被撤下。该模型原定于 6 月推出,但多次跳票。#谷歌AI# 此次短暂露面,暗示测试可能已进入最后阶段。...
2026-07-31
·
浏览46次
消息称阿里千问模型已在特斯拉车机内测,号称能听能答、能控车、能导航
消息称阿里千问模型已在特斯拉车机内测,目前已在真实车机环境完成大量测试,可支持语义理解、控车导航等能力,已有多家国内头部车企宣布接入该模型。#阿里千问大模型#...
2026-07-31
·
浏览42次
DeepSeek-V4-Flash 正式版 API 上线公测,V4-Pro 正式版将“尽快”发布
今天(31 日)下午,DeepSeek 通过 API 文档发布日志,宣布 DeepSeek-V4-Flash 正式版 API 上线公测。...
2026-07-31
·
浏览91次
韩国最大人工智能基础模型:LG AI 研究院发布 750B 参数 K-EXAONE 2.0
K-EXAONE 2.0 采用混合注意力 MoE 架构,拥有 750B 总参数和 37B 激活参数,规模是 236B-A23B 的初代 K-EXAONE 的 3 倍以上。...
2026-07-31
·
浏览63次
Anthropic:第三方评估环境配置失误,导致三起真实网络安全事件
这三次事件中 Anthropic 的模型都被指派了无限制的“夺旗”网络攻击任务。此类任务的测试环境需与真实互联网隔离,但错误配置导致模型实际上拥有真实互联网访问权限。...
2026-07-31
·
浏览47次
AI 中文社