搜索 “评估”,找到 14 个工具
Promptable是一款面向GPT提示工程的管理工具,支持组织提示词、记录版本变更、评估效果和部署流程,适合系统化管理AI提示开发工作。
GeniusReview 是一款用于 360 度绩效评估的 AI 工具,可根据员工岗位生成个性化评语与反馈建议,并支持对多项能力进行评分,帮助团队更高效地完成绩效评审。
PROMPTMETHEUS 是一款无代码提示工程工具,用于组合、测试和评估 OpenAI 提示词,支持模型对比、结果评分、成本估算及数据导出。
Pickapic 是一个面向 AI 研究的图像生成与评估工具,用户可以根据文本生成图片、进行排序和下载,以人类反馈支持文本生成图像模型的改进。
User Evaluation是一个提供人工智能工具进行研究的网站,包括面试摘要和趋势分析报告。该网站允许用户免费注册,并提供UI、UX研究、产品设计和产品管理等功能。该网站还具有人工智能聊天功能,并提供与其他工具的集成。用户可以登录网站或使用Google帐户注册。
Validator AI 是一款创业想法验证工具,借助人工智能对商业点子进行初步分析,并提供可行性反馈与改进建议,帮助用户更清晰地评估项目方向。
MindSmith 是一款 AI 驱动的微学习课程创建工具,可用于制作和分享微型课程、测验与评估内容,适合培训、教学和知识快速传播场景。
Teachology.ai是一组面向教师和教育工作者的AI教学工具,可用于生成课程计划、评估内容和测验题,并支持多种格式导出,辅助日常教学准备。
Hirex.ai 是一款无代码语音面试机器人平台,可自动化执行大规模招聘评估。它支持语音面试,并整合编码测试、选择题、视频面试、黑客马拉松和 WhatsApp 聊天机器人等功能。
SchoolAI 是面向教师和学校管理者的教育工具,提供教案生成、形成性评估、个性化资源推荐以及多种教学辅助模式,支持课堂与备课场景。
Hairgen AI 是一款用于毛发移植术前效果预览的 AI 工具,用户可上传个人照片,生成多种植发后的发型变化,帮助在手术前更直观地评估可能效果。
FlagEval(天秤)是北京智源人工智能研究院(BAAI)推出的科学、公正、开放的大模型评测体系及开放平台,为研究人员提供全面评估基础模型及训练算法性能的工具和方法。FlagEval采用“能力-任务-指标”三维评测框架,从多个维度对大模型的认知能力进行评估,涵盖对话、问答、情感分析等多种应用场景,提供超过22个数据集和8万道评测题目。
H2O EvalGPT 是 H2O.ai 用于评估和比较 LLM 大模型的开放工具,它提供了一个平台来了解模型在大量任务和基准测试中的性能。无论你是想使用大模型自动化工作流程或任务,H2O EvalGPT 都可以提供流行、开源、高性能大模型的详细排行榜,帮助你为项目选择最有效的模型完成具体任务。
Stable Chat 是 Stability AI 最新推出的一款类似于 ChatGPT 或 Claude 的对话式 AI 助手的研究预览版,旨在成为研究人员和 AI 爱好者评估 Stability AI 模型的功能和安全性的一种方式,该 AI 聊天机器人基于 Stable Beluga 大语言模型。
