探索我们精选类别中最好的AI大型语言模型工具。深入研究最先进的解决方案,比较功能并利用LLM的功能。
ChatGPT 是 OpenAI 的对话式大型语言模型,您可以通过 chatgpt.com 网站、iOS 和 Android 访问。您可以输入或语音输入提示,它会用通俗语言回答,跟进之前的信息,还能起草代码、总结文件、生成图像,或在一个对话线程中执行多步骤研究。 与需要您自行连接的原始 API 访问不同,ChatGPT 集成了前沿的 GPT-5.6 模型、记忆、自定义 GPT、语音以及如 ChatGPT Work 和 Codex 这样的代理工作流,所有功能均通过单一登录实现。其权衡是对模型参数的控制较少,且免费和 Go 版本的使用限制比直接调用 API 更严格。 它适合撰写论文的学生、调试...
ChatGPT Plugins 是 OpenAI 2023 年的扩展系统,允许 ChatGPT 调用第三方 API 以获取实时数据、进行计算和使用外部服务。插件作为模型在对话中可调用的工具出现,用户需在 ChatGPT 中启用它们。OpenAI 2023 年 3 月的公告列出了包括 Expedia、Instacart、KAYAK、Klarna、OpenTable、Shopify、Slack、Wolfram 和 Zapier 在内的启动合作伙伴。 测试版还提供了 OpenAI 自建的插件,包括通过 Bing 进行网页浏览、一个沙箱环境的 Python 代码解释器,以及一个用于私人文档搜索的开源...
Auto-GPT是一个实验性开源应用程序,展示了GPT-4语言模型的功能。该程序由GPT-4驱动,将LLM“ Thought”链接在一起,以自主实现您设定的任何目标。作为GPT-4完全自动运行的第一个示例之一,Auto-GPT推动了AI可能的边界。 <b> Quickstart:</b> 查看Wiki 获取OpenAI API键 下载最新版本 遵循安装说明 配置您想要的任何其他功能,或安装一些插件 运行应用程序
DeepSeek Coder 是 DeepSeek 推出的开源代码语言模型系列。该系列包括基础和指令调优版本,参数量从 1B 到 33B 不等,全部在包含 87% 代码和 13% 英语及中文自然语言的 2 万亿标记上从零开始训练。权重已在 Hugging Face 上发布,你可以通过 chat.deepseek.com 试用这些模型,或在 GitHub 仓库中使用示例在本地运行。 这些模型面向项目级工作,而不仅仅是单行代码片段。训练采用 16K 标记窗口和填空任务,使模型能够在仓库的多个文件中完成或插入代码。在仓库中公布的基准测试结果显示,DeepSeek-Coder-Base-33B 在 ...
Claude 3 是 Anthropic 推出的第三代大型语言模型系列,于 2024 年 3 月发布。它包括三个层级:Haiku(速度与成本优先)、Sonnet(性能平衡)和 Opus(最高推理深度)。每个模型针对不同的智能、延迟和价格之间的权衡进行优化。 该系列处理文本、代码、分析和视觉任务。Claude 3 模型可以处理照片、图表、图形和技术图解。在发布时,支持 20 万 tokens 的上下文窗口,部分客户还能使用超过 100 万 tokens 的输入。Opus 和 Sonnet 在 claude.ai 和 Claude API 上上线支持 159 个国家,Haiku 紧随其后不久也将...
FinetuneFast 是一个付费的机器学习模型微调和部署的模板包。它整合了预配置的训练脚本、数据加载管道、超参数优化和部署模板,帮助开发者比从零开始建造更快地从设置过渡到生产。 该包涵盖文本到图像、大型语言模型、RAG(检索增强生成)应用及相关工作流程。示例中包括 AWS Bedrock、Mistral AI 和 OpenAI 等提供商的参考内容,以及 Flux-Schnell 文本到图像、Fish-Speech 语音合成和检索增强生成的模板。 购买后,用户可以访问含有文档的 GitHub 仓库资料。All In 计划还包括 Discord 社区准入和终身更新。创始人 Patrick ...
五个从125M到120B参数的开放权重检查点,为研究人员提供了一个科学训练的语言模型,该模型基于1060亿个精心策划的标记,涵盖4800万篇论文、教科书、百科全书和知识库。Galactica在一个仅解码器的Transformer架构内存储、组合并推理多种模态,包括LaTeX、Python代码、SMILES公式和氨基酸序列。Meta的Papers with Code团队开源了权重,供希望研究语言模型如何组织科学知识的研究人员使用。 通用大型语言模型训练于广泛的网络爬取数据,其中社交聊天可能占据标记预算的主导。Galactica仅使用经过策划的开放获取科学资源,论文认为这使其能够进行多轮训练而不...
介绍了您的私人AI助手Sanctum,它将AI的精致效果直接带给您的桌面,并具有最大的隐私和便利性。 Sanctum是针对Apple Silicon和Intel处理器的支持,可针对MacOS 12+提供支持,是一种创新的工具,使您可以在本地计算机上运行并与功能丰富的开源大型语言模型(LLMS)进行交互。忘记云 - 您的数据已加密,安全并留在设备的范围内,提供无与伦比的隐私。无论是个人用途,数据敏感的任务还是开发项目,Sanctum都采用隐私优先的方法来确保您的AI交互保持自己。凭借预期的移动版本和即将发布的更新,例如其他模型支持和多平台兼容性,Sanctum承诺将处于可访问且安全的AI工具的最...
ggml 通过一个紧凑的 C 张量库,在日常使用的 CPU 和 GPU 上运行大型语言和语音模型,专为设备端推理构建。机器学习工程师和应用开发者通过 llama.cpp 和 whisper.cpp 采用它,以便在无需云端依赖的情况下运行 LLaMA 或 Whisper 工作负载。 像 PyTorch 这样的框架针对训练集群和重度运行时进行了优化。ggml 保持核心库的简洁,零运行时内存分配,无第三方依赖,并采用整数量化,因此 llama.cpp 能在笔记本和 Apple Silicon 上提供 Meta LLaMA 权重服务。 ggml.ai 公司由 Georgi Gerganov 于 2...
GPT-4 是 OpenAI 开发的大型语言模型,专为高级推理、遵循指令以及在文本任务中提供更安全的响应而设计。OpenAI 将其定位为 GPT 研究系列的继任者,并通过 ChatGPT Plus 和开发者 API 提供使用。产品页面强调了发布前通过人类反馈和专家审查进行的对齐工作。 与早期的 GPT-3.5 聊天模型相比,GPT-4 更注重可衡量的安全性和事实准确性的提升,而不仅仅是参数数量的增加。OpenAI 报告称,在内部测试中,GPT-4 回答不允许请求的概率降低了 82%,给出事实性回复的概率比 GPT-3.5 高出 40%。这一权衡针对需要更强防护措施的团队,即使延迟和成本高于较...
GLM-130B 将一个拥有1300亿参数的双语语言模型纳入了由THUDM基于通用语言模型(GLM)预训练方案构建的开放研究框架中。该模型权重针对英语和中文文本,GitHub仓库提供了推理代码、评估任务以及在ICLR 2023接受的检查点。您可以在单个多GPU服务器上运行从左到右的生成或使用[MASK]和[gMASK]标记的空白填充,而无需依赖专有API。 大多数超过1000亿参数的模型都保持封闭,GLM-130B则公开了模型权重、训练笔记和30多个基准测试的YAML配置。其INT4量化路径经过调优,使得四张RTX 3090(24GB)显卡几乎无精度损失地支持推理,这远低于用于完整FP16运...
MosaicML 提供了一个强大的平台,旨在在您自己的环境中轻松、安全地训练和部署大型语言模型和其他生成式 AI 模型。 MosaicML 迎合从初创企业到生命科学和联邦服务等行业的需求,让尖端人工智能触手可及。用户可以使用单个命令轻松地大规模训练人工智能模型,并将其部署在私有云中,同时保留模型的完全所有权,包括其权重。 MosaicML 因其对数据隐私、企业级安全性和完整模型所有权的承诺而脱颖而出。此外,通过优化效率以及与各种工具和云环境的兼容性,MosaicML 实现了变革性 AI 功能的民主化,同时最大限度地减少了与大规模 AI 模型管理相关的技术挑战。