测试 标签,匹配到约3895个结果, 耗时0.0217秒
“小号”美国最强开源模型:Inkling-Small 登场,约 1/4 规模提供相近 AI 性能
Thinking Machines Lab 昨日(7 月 30 日)发布博文,宣布推出 Inkling-Small 模型,其性能媲美 Inkling,但规模降低至约四分之一。...
2026-07-31
·
浏览33次
最严苛 AI 交互推理测试:OpenAI 两项改进让 GPT-5.6 Sol 提分 188%
ARC Prize ARC 奖 ARC 奖 ARC 奖团队推出的全新交互式推理基准测试,旨在衡量人工智能代理(AI Agent)在未知和动态环境中的类似人类的智能与技能获取效率...
2026-07-31
·
浏览31次
谷歌最新 AI 大模型 Gemini 3.5 Pro 短暂上线 Arena 竞技场,已延迟数月
据多位用户反馈,鸽了许久的谷歌 Gemini 3.5 Pro 大模型今日短暂现身 AI 盲测平台 Arena,上线仅 30 分钟便被撤下。该模型原定于 6 月推出,但多次跳票。#谷歌AI# 此次短暂露面,暗示测试可能已进入最后阶段。...
2026-07-31
·
浏览34次
消息称阿里千问模型已在特斯拉车机内测,号称能听能答、能控车、能导航
消息称阿里千问模型已在特斯拉车机内测,目前已在真实车机环境完成大量测试,可支持语义理解、控车导航等能力,已有多家国内头部车企宣布接入该模型。#阿里千问大模型#...
2026-07-31
·
浏览31次
DeepSeek-V4-Flash 正式版 API 上线公测,V4-Pro 正式版将“尽快”发布
今天(31 日)下午,DeepSeek 通过 API 文档发布日志,宣布 DeepSeek-V4-Flash 正式版 API 上线公测。...
2026-07-31
·
浏览76次
韩国最大人工智能基础模型:LG AI 研究院发布 750B 参数 K-EXAONE 2.0
K-EXAONE 2.0 采用混合注意力 MoE 架构,拥有 750B 总参数和 37B 激活参数,规模是 236B-A23B 的初代 K-EXAONE 的 3 倍以上。...
2026-07-31
·
浏览41次
Anthropic:第三方评估环境配置失误,导致三起真实网络安全事件
这三次事件中 Anthropic 的模型都被指派了无限制的“夺旗”网络攻击任务。此类任务的测试环境需与真实互联网隔离,但错误配置导致模型实际上拥有真实互联网访问权限。...
2026-07-31
·
浏览34次
新研究:AI 对就业市场的真正威胁不是失业,而是让加薪更困难
最新研究显示,AI 暂未对整体就业产生可检测影响,但会显著压低工资增速,低收入劳动者受冲击最明显,未来或将进一步加剧收入不平等。...
2026-07-31
·
浏览31次
Meta 借助 AI 大幅缩短应用开发周期,更多新应用已在路上
近期推出的产品包括面向 Marketplace 卖家的应用、Facebook 群组应用、通过“氛围编程”打造的游戏应用、Instagram 照片应用,以及 AI 睡前故事实验。...
2026-07-31
·
浏览37次
研究显示:AI 聊天机器人实施情感诈骗的能力已超越人类
四所大学联合研究测试发现,AI 聊天机器人在恋爱诈骗这类“长期骗局”中,获取受害者信任的效果远超人类,同意诈骗请求的比例接近一半。#AI诈骗#...
2026-07-30
·
浏览54次
马斯克:Grok 4.6 将于 8 月 7 日发布,几周后推出 2.1 万亿参数 Grok 4.7
马斯克透露 Grok 4.6 和 Grok 4.7 的发布计划,两款模型参数分别达 1.5 万亿、2.1 万亿,将在性能方面获得显著提升。#Grok大模型#...
2026-07-30
·
浏览51次
马斯克旗下 SpaceXAI 最智能 AI 语音模型,Grok Voice Think Fast 2.0 登场
埃隆 · 马斯克(Elon Musk)旗下 SpaceXAI 公司昨日(7 月 29 日)发布 Grok Voice Think Fast 2.0,是其功能最强大、最智能的语音对语音(speech-to-speech) AI 模型。...
2026-07-30
·
浏览46次
OpenAI 部署 GPT-5.6 优化模型自身推理性能,端到端服务成本最多降低 20%
OpenAI 公司昨日(7 月 29 日)发布博文,宣布通过 GPT-5.6 Sol 模型,来优化 GPT-5.6 系列模型本身 AI 推理链路,端到端服务成本最多降低 20%。...
2026-07-30
·
浏览43次
谷歌旗下 Wiz 公布漏洞挖掘系统 Atlas:利用多个 AI 智能体分工协作、已发现超 200 个漏洞
谷歌旗下 Wiz 发布 AI 智能体系统 Atlas,它像人类安全团队一样分工协作,以多阶段、程序化方式自主挖掘软件漏洞。系统已在实际应用中检测出超 200 个此前未知的安全漏洞,并因此获得 GitHub 10 万美元奖金。#AI安全# #...
2026-07-29
·
浏览53次
AI 中文社