BigBang Transformer[乾元]是基于GPT Decoder-only架构的大规模预训练模型。继2022年开源BBT-1-0.2B模型之后,我们正式开源最新系列的BBT模型:BBT-1-1B,BBT-2-12B-Text,BBT-2.5-13B-Text。预训练语料库覆盖14个高质量数据源,覆盖书籍、百科、论文、小说、新闻、政策文件、中文博客、社交媒体等多个数据源种类。BBT-2-12B-Text基于中文700亿tokens进行预训练,经过指令微调的BBT-2基础模型可以回答百科类和日常生活的问题。BBT-2.5-13B-Text基于中文+英文 2000亿tokens进行预训练。
模型开源后所有开发者可以:
1. 可以直接调用大模型进行对话
2. 在我们训练的基础上使用自由语料库继续训练
3. 对大模型进行微调训练以满足各种下游任务
类似的工具
xAI Grok
使用xai的大型语言模型(LLM)进行聊天
K2-上海交通大学
一个地球科学的开源大预言模型
零一万物-官网01.ai
以 Project AI2.0 之名入局大模型
阅文妙笔大模型
全面探索有声、漫画、动画、衍生等开发链条的AI应用。
Kimi Chat
一口气读完二十万字的小说
MediaGPT:中文自媒体大模型
一个针对自媒体领域进行特殊训练的模型
他人最近看的工具
NeverEnds
生成更具电影感、真实性和实用性的AI镜头
百度·文心一言
百度全新一代知识增强大语言模型
Verbatik
Verbatik是一款由人工智能驱动的文本到语音生成器,提供了一个不断增长的库,包含142种语言和口音的600多种自然声音。
Kaggle 机器学习课
Kaggle 机器学习课
[新]BeePOP
上传一张 SKU 图片,几分钟内生成完整 Amazon Listing 图片与 A+ Content——免费试用
