HELM
斯坦福大模型标准化评测平台
HELM是由斯坦福大学推出的大模型评测体系,该评测方法主要包括场景、适配、指标三个模块,每次评测的运行都需要指定一个场景,一个适配模型的提示,以及一个或多个指标。
「大模型」是 芝麻派AI 下的 AI 资源专题分类,收录 67 款相关工具。你可以在本页按热度与更新时间浏览,并进入详情页查看功能说明、适用场景与同类对比。 热门包括:AI Ping、K2-上海交通大学、通义万相。
选型建议:挑选「大模型」工具时,先明确使用场景(个人 / 团队 / 企业),再对比免费额度、中文支持与国内访问;芝麻派AI 各资源详情页提供「同类备选」便于横向对比。
「大模型」是 芝麻派AI 下的 AI 资源专题分类,收录 67 款相关工具。你可以在本页按热度与更新时间浏览,并进入详情页查看功能说明、适用场景与同类对比。 热门包括:AI Ping、K2-上海交通大学、通义万相。
本站热门推荐:AI Ping(AI智能评测与推荐平台);K2-上海交通大学(上海交大开源语音识别工具);通义万相(阿里AI创意生成平台);AutoDL.Art(AI模型训练与部署平台);问小白(智能问答助手,快速解惑)。
挑选「大模型」工具时,先明确使用场景(个人 / 团队 / 企业),再对比免费额度、中文支持与国内访问;芝麻派AI 各资源详情页提供「同类备选」便于横向对比。
斯坦福大模型标准化评测平台
HELM是由斯坦福大学推出的大模型评测体系,该评测方法主要包括场景、适配、指标三个模块,每次评测的运行都需要指定一个场景,一个适配模型的提示,以及一个或多个指标。
元象大模型智能对话助手
元象XChat是基于自研XVERSE-65B-2大模型的AI助手,在中文处理上表现突出。它提供文本创作、多语言翻译、知识问答和代码生成等功能,适用于营销、办公、客服、编程及教育等多种场景。用户可通过网页免费试用,开发者也可获取开源资源进行集成。
大模型性能权威评测榜单
OpenCompass LLM排行榜是一个开源的大语言模型评估平台,提供超过100个数据集的基准测试,涵盖知识、逻辑、数学、代码等维度。榜单实时更新,展示GPT-4、Claude、Qwen等开源与商业模型的综合性能排名,为研究者和开发者提供客观的模型选择参考。
AI驱动的企业级数字营销平台
万联摩尔是面向全产业的AI大模型平台,覆盖97个行业大类。平台提供产业知识问答、AI研报创作、价格预测和企业洞察等功能,帮助金融分析师、研究员和企业决策者基于可信数据高效工作,支持从数据查询到报告输出的全流程。
上海交大开源语音识别工具
K2是一个专为地球科学设计的开源大语言模型。它基于LLaMA架构,首先在大量地球科学文献(包括开放获取论文和维基百科)上进行领域预训练,再使用知识密集型指令数据GeoSignal进行微调。在由NPEE和AP地质、地理、环境科学测试组成的GeoBench基准评估中,K2在多项客观与主观任务上表现优于同类参数规模的基线模型。该项目将开源相关代码与数据。
AI驱动的智能客服与营销平台
Qpipi是国内专注Stable Diffusion AI绘画的一站式平台,提供模型下载、安装教程、实战案例与Prompt分享。从新手入门到进阶创作,覆盖SD WebUI、ComfyUI、Fooocus等工具,解决模型难找、安装复杂、参数不会调等问题。
AI智能写作与内容生成助手
SparkAI系统整合了ChatGPT、DeepSeek推理模型、Midjourney绘画等多种AI技术,提供智能问答、文档分析、图像生成、语音交互及企业API服务。平台支持个人创意、开发者集成与企业级应用,具备多模型轮询、高并发处理与多端适配能力。
本地偏好 · 配色仅保存在当前浏览器
点此注册,收藏与评论更方便
Welcome! This site is in Chinese. Tap EN in the top bar to read in English.