AI模型 标签,匹配到约31个结果, 耗时0.0388秒
韩国最大人工智能基础模型:LG AI 研究院发布 750B 参数 K-EXAONE 2.0
K-EXAONE 2.0 采用混合注意力 MoE 架构,拥有 750B 总参数和 37B 激活参数,规模是 236B-A23B 的初代 K-EXAONE 的 3 倍以上。...
2026-07-31
·
浏览61次
黄仁勋谈中美AI未来:人才是关键 中国能产出卓越的AI技术
快科技7月26日消息,据媒体报道,昨日,英伟达创始人兼CEO黄仁勋在接受媒体采访时表示,中国注定能产出卓越的AI技术,中美两国应当继续推动AI发展。
黄仁勋表示,中美两国都拥有出色的AI研究人...
2026-07-26
·
浏览99次
谷歌发布三款新 AI 模型,含 Gemini 3.6 Flash、3.5 Flash Cyber
谷歌发布三款 Gemini 新模型,包括性能更强的 3.6 Flash 和专攻网络安全的 3.5 Flash Cyber,旨在提升效率并降低成本。网络安全正成为 AI 竞争新焦点,谷歌将效仿对手,对安全模型采取有限开放策略。#AI大模型# ...
2026-07-21
·
浏览108次
Sakana AI 推出网络安全模型 Fugu Cyber:领域基准测试表现优于 GPT-5.5-Cyber
Fugu Cyber 在 CyberGym 安全基准测试中成功率达 86.9%,CTI-REALM 测试成功率也达到 72.1%。...
2026-07-21
·
浏览100次
Meta 正式向开发者开放 Muse Spark AI 模型 API,加入 AI 商业化竞争
Meta 正式向开发者开放 Muse Spark AI 模型 API,并推出升级版 1.1。该模型在编程和 AI 智能体任务方面能力最强,开发者现可申请测试并按 Token 付费。此举标志 Meta 正式进入 AI 模型收费市场,与 Ope...
2026-07-09
·
浏览155次
消息称 OpenAI 通过系统底层优化,将 AI 模型推理成本减半
OpenAI 工程师透露,公司通过提升服务器资源利用率等底层优化,成功将 AI 模型的推理成本降低了 50% 以上。这意味着运行 AI 所需的英伟达芯片更少,节省的成本可用于降低 API 定价或提高用户使用限额。#AI成本##OpenAI#...
2026-06-30
·
浏览151次
让 Anthropic Fable 5 模型下架的“幕后黑手”,竟是自家股东亚马逊
亚马逊 CEO 向美国政府报告,其研究人员发现 Anthropic 的 Claude Fable 5 模型存在可被用于网络攻击的漏洞,导致美国政府对 Fable 5 和 Mythos 5 下达出口管制禁令,并引发全球停用。事件凸显了前沿 A...
2026-06-14
·
浏览198次
Anthropic 禁用 Fable 5 模型,亚马逊 CEO 贾西或是背后导火索
亚马逊 CEO 向美国政府报告,其研究人员发现 Anthropic 的 Claude Fable 5 模型存在可被用于网络攻击的漏洞,导致美国政府对 Fable 5 和 Mythos 5 下达出口管制禁令,并引发全球停用。事件凸显了前沿 A...
2026-06-14
·
浏览209次
英伟达发布 5500 亿参数 Nemotron 3 Ultra 开源模型,较同级别前沿模型推理速度最高提升 5 倍
英伟达发布全新开源模型 Nemotron 3 Ultra,拥有 5500 亿参数,专为全天候运行的智能体设计。相比同级别模型,其推理速度最高提升 5 倍,使用成本降低 30%,已适配主流智能体平台。该模型将助力企业打造更高效、低成本的 AI...
2026-06-01
·
浏览303次
消息称 Meta 新一代模型即将发布,执行开源与闭源混合策略
Meta 了解其新模型可能无法在所有方面与新的竞品相竞争,但相信它会在某些方面具有吸引消费者的优势...
2026-04-07
·
浏览271次
Mistral 发布 119B-A6B 模型 Small 4,首次兼顾推理、多模态、编程优势
Mistral Small 4 以 Apache 2.0 许可开源,在三个基准测试中均不劣于 OpenAI 的 GPT-OSS 120B。...
2026-03-20
·
浏览292次
Waymo 发布世界模型,可模拟龙卷风、大象侵路等异常罕见事件
Waymo 世界模型的基石谷歌 Genie 3 为其提供了广泛的知识基础,使其几乎可以生成任何场景。...
2026-02-09
·
浏览1122次
Mistral AI 发布 Voxtral Transcribe 2 系列语音转文字模型,其一延迟不足 0.2s
另一方面,Voxtral Mini Transcribe V2 拥有目前性价比最高的转录 API,准确率表现优于 GPT-4o mini Transcribe、Gemini 2.5 Flash。...
2026-02-05
·
浏览338次
MiniMax 更新 M2.1 模型,重点聚焦于更多编程语言和办公场景的可用性
MiniMax-M2.1 致力于提升真实世界复杂任务中的表现,系统性提升了非 Python 语言的能力、模型回复以及思维链更加简洁。...
2025-12-24
·
浏览660次
Mistral 推出 Devstral 2 模型家族,宣称表现在开源编程智能体中一流
Mistral 表示 Devstral 2 (123B) 的参数规模远小于竞品,成本效益是 Claude Sonnet 的 7 倍以上。...
2025-12-10
·
浏览402次
Anthropic 发布 Claude Opus 4.5:强化编码与长任务处理,软件工程测试成绩超越人类
Anthropic发布最新AI模型Claude Opus 4.5,在编码、智能体及计算机操作方面表现领先,软件工程测试成绩超越人类。该模型已在Anthropic应用、API及三大云平台开放使用,定价5美元/百万tokens输入,25美元/百...
2025-11-25
·
浏览377次
Hugging Face 联合创始人沃尔夫:当前的 AI 模型不太可能带来重大科学突破
沃尔夫指出当前聊天机器人存在两大问题:ChatGPT 及类似的产品往往会迎合提问者的观点,比如你提问后,机器人可能会称赞你的问题很有趣或很棒;这些聊天机器人的底层模型设计目标是“预测句子中最可能出现的下一个词”。...
2025-10-02
·
浏览399次
小红书首个多模态 AI 大模型 dots.vlm1 发布并开源,基于 DeepSeek V3 LLM
小红书 hi lab 表示,dots.vlm1 在大部分多模态评测集上接近闭源 SoTA 模型的水平,并在文本能力和主流文本模型相当。...
2025-08-06
·
浏览510次
AMD 联手 Stability 推首款 BF16 精度 SD 3.0 Medium 模型,针对 XDNA 2 NPU 优化
这一模型适用于 AMD 锐龙 AI 300 / 锐龙 AI Max 300 系列处理器,需要系统内存 24GB、运行实际内存占用 9GB。...
2025-07-22
·
浏览501次
Mistral 推出 Voxtral 系列语音理解模型:以开源形式提供一流正确率表现
该模型支持 32K Token 的上下文长度,可处理 30 分钟音频转录或 40 分钟音频理解,内置生成相关问题、结构化摘要的能力。...
2025-07-17
·
浏览518次
Mistral 推出 Voxtral 系列语音理解模型:以开源形式提供出色正确率表现
该模型支持 32K Token 的上下文长度,可处理 30 分钟音频转录或 40 分钟音频理解,内置生成相关问题、结构化摘要的能力。...
2025-07-16
·
浏览429次
微软 AI 高管直言:有时 OpenAI 模型交付不及时,自研模型落后 3 到 6 个月
微软与OpenAI价值数十亿美元的合作关系出现裂痕。微软AI负责人表示OpenAI未能及时提供AI模型,导致技术整合困难。OpenAI则称技术转移过程复杂。微软已开始开发内部AI模型作为备选方案。#微软OpenAI合作危机# #AI技术竞争...
2025-05-19
·
浏览542次
研究发现:要求 AI 简洁作答可能致其出现更多“幻觉”
巴黎AI公司Giskard研究发现,要求AI聊天机器人简短回答问题时,其产生“幻觉”(输出虚假信息)的概率会显著增加。包括GPT-4o在内的主流模型均存在此现象,因简洁回答缺乏反驳错误的空间。#AI幻觉##ChatGPT#...
2025-05-08
·
浏览558次
Meta 恢复在欧盟使用用户公开数据训练 AI 模型,曾因隐私问题暂停
Meta宣布恢复在欧盟使用Facebook和Instagram上的公开内容训练AI模型,用户将收到通知并可选择退出。此举遵循GDPR规定,Meta强调不会使用私人消息及未成年用...
2025-04-15
·
浏览443次
AI 中文社