刚刚,DeepSeek开源FlashMLA,推理加速核心技术,Star量飞涨中
上周五,DeepSeek 发推说本周将是开源周(OpenSourceWeek),并将连续开源五个软件库。...
2025-02-25
·
浏览344次
扩散模型新突破!无需微调,就能高效稳定移除目标物体
最近,扩散模型在生成模型领域异军突起,凭借其独特的生成机制在图像生成方面大放异彩,尤其在处理高维复杂数据时优势明显。...
2025-02-25
·
浏览555次
从o1-mini到DeepSeek-R1,万字长文带你读懂推理模型的历史与技术
自 OpenAI 发布 o1-mini 模型以来,推理模型就一直是 AI 社区的热门话题,而春节前面世的开放式推理模型 DeepSeek-R1 更是让推理模型的热度达到了前所未...
2025-02-25
·
浏览696次
速度提高40w倍,牛津新的ML策略计算蛋白的自由能扰动,助力药物发现
牛津大学的研究团队首先提出了一种新的基于注意力的图神经网络模型 AEV-PLIG(原子环境向量-蛋白质配体相互作用图),以解决这些问题。其次,他们提出了一种新的、更真实的分布外...
2025-02-25
·
浏览353次
官方承认系统「作弊」,世界首个「AI CUDA工程师」翻车?o3-mini 11秒发现bug
官方承认系统「作弊」,世界首个「AI CUDA工程师」翻车?o3-mini 11秒发现bug...
2025-02-25
·
浏览332次
刚刚,全球首个混合推理模型Claude 3.7降世!最强编程大脑暴击DeepSeek R1
刚刚,全球首个混合推理模型Claude 3.7降世!最强编程大脑暴击DeepSeek R1...
2025-02-25
·
浏览495次
8分钟,Grok 3破解美国本科生最难数赛题!马斯克要用100万GPU反超「星际之门」?
8分钟,Grok 3破解美国本科生最难数赛题!马斯克要用100万GPU反超「星际之门」?...
2025-02-24
·
浏览438次
南大钱超团队攻克百亿晶体管难题,斩获EDA顶会2025最佳论文!AI学院本硕博生联手
南大钱超团队攻克百亿晶体管难题,斩获EDA顶会2025最佳论文!AI学院本硕博生联手...
2025-02-24
·
浏览381次
DeepSeek开源放大招:FlashMLA让H800算力狂飙!曝光低成本秘笈
DeepSeek开源放大招:FlashMLA让H800算力狂飙!曝光低成本秘笈...
2025-02-24
·
浏览546次
3倍提速!现在你跑不过机器狗了,限制波士顿动力机器狗的竟然是电池功率?
当 Scaling Law 在触顶边界徘徊之时,强化学习为构建更强大的大模型开辟出了一条新范式。...
2025-02-24
·
浏览361次
DeepSeek-R1 成 Hugging Face 最受欢迎大模型,力压近 150 万个“对手”
Clement Delangue今日凌晨发文宣布:DeepSeek-R1在Hugging Face上获得了超过10000个赞,成为该平台近150万个模型之中最受欢迎的大模型,“...
2025-02-24
·
浏览549次
谷歌 AI 视频生成模型 Veo 2 使用费用公布:每分钟 30 美元
谷歌近期在其定价页面上低调公布了新一代 AI 视频生成模型 Veo 2 的使用费用。该模型于去年 12 月首次亮相,旨在通过人工智能技术快速生成高质量的视频内容。根据官方信息,...
2025-02-24
·
浏览792次
超 20 家央企接入 DeepSeek,涉及能源、通信、汽车等领域
据经济参考报报道,近来,国资央企“牵手”DeepSeek 已成为一股新风潮。据不完全统计,目前有超 20 家央企接入 DeepSeek,涉及能源、通信、汽车、金融、建筑等多个领...
2025-02-24
·
浏览475次
OpenAI 最新研究:当前 AI 模型仍无法媲美人类程序员
尽管 OpenAI 首席执行官萨姆・奥尔特曼(Sam Altman)坚称,到今年年底,人工智能模型将能够超越“低级别”软件工程师,但该公司研究人员的最新研究却表明,即使是目前最...
2025-02-24
·
浏览423次
DeepSeek 代码库开源进度 1/5:为 Hopper GPU 优化的高效 MLA 解码内核 FlashMLA
DeepSeek今日启动“开源周”,首个开源的代码库为FlashMLA——针对 Hopper GPU 优化的高效 MLA 解码内核,支持可变长度序列。...
2025-02-24
·
浏览515次
Grok 3冲击诺奖级突破,成证明「黎曼猜想」关键!AI与数学家打出终极组合拳
Grok 3冲击诺奖级突破,成证明「黎曼猜想」关键!AI与数学家打出终极组合拳...
2025-02-23
·
浏览455次
孙正义患DeepSeek焦虑症?首谈5000亿星际之门,每年算力暴增1000倍
孙正义患DeepSeek焦虑症?首谈5000亿星际之门,每年算力暴增1000倍...
2025-02-23
·
浏览502次
一次推理解决复合问题:基于MoE的大语言模型知识模块可扩展融合推理架构MeteoRA
在大语言模型领域中,预训练 + 微调范式已经成为了部署各类下游应用的重要基础。...
2025-02-23
·
浏览488次
AI 中文社