Generrated
Generrated 是为 DALL·E 2 和 DALL·E 3 用户提供参考与灵感平台。Generrated展示超过 9,300 张由 AI 绘图工具生成的图像,附带生成图像所用的文本提示。用户点击图像能查看提示用语,还能浏览同一提示生成的所有图像,对比不同版本的风格差异。
LangGPT
LangGPT是一种新型的提示词设计工具,提出了一种结构化和可复用的提示词编写方法论,帮助用户编写高质量的提示词。工具受到编程语言的启发,设计了双层结构的提示设计框架,易于学习和应用。
AI Short
AI Short是AI提示词管理和共享平台,通过提供标签筛选、关键词搜索和一键复制提示词的功能,帮助用户提升与AI对话的效率和质量。用户可以在这个平台上找到适合不同场景的提示词,无论是工作、学习还是创意写作,通过优化的提示词获得更精确、实用的反馈,有效提升生产力。
AI Prompt Generator
AI Prompt Generator是一个多功能的在线AI提示生成器工具,能帮助用户为不同的AI模型生成精准的提示词。工具支持ChatGPT、Claude、Midjourney和Stable Diffusion等多种模型。
ClickPrompt
ClickPrompt 是专为 AI 提示词(Prompt)编写者设计的在线工具,帮助用户更高效地生成和优化用于 AI 模型的提示词。支持多种流行的 AI 应用,如 Stable Diffusion(AI 绘图)、ChatGPT(AI 对话)和 GitHub Copilot(代码辅助)等。
PromptHero
PromptHero 是专注于 AI 提示词优化与搜索的平台,帮助用户提升与 AI 模型交互的效率和效果。支持多种主流 AI 模型,如 Stable Diffusion、Midjourney 和 DALL-E 等,提供高质量的提示词搜索功能,涵盖图像生成和文本生成两大领域。
PromptPerfect
PromptPerfect 是一款专业好用的提示词优化工具,可帮助用户一站式设计、开发、优化和部署提示词,支持GPT-4、ChatGPT、文心一言、Claude、Llama、Midjourney、Stable Diffusion等各大主流文本和图像模型的提示词。
提示工程指南Prompt Engineering Guide
提示工程指南(Prompt Engineering Guide)是由 DAIR.AI 发起的项目,旨在帮助研发和行业内相关人员了解提示工程。以传播 AI 技术和研究成果为目标,DAIR.AI 的愿景是赋能新一代 AI 领域的创新者。该项目在GitHub上已超过3万个人标星,包含了与 LLM 提示工程相关的所有最新论文、学习指南、讲座、参考资料和工具。
PromptPilot
PromptPilot 是火山方舟推出的AI提示词解决方案平台,能优化大语言模型的输入指令(Prompt)。平台通过智能算法,将用户的任务描述转化为高效的 Prompt 方案,在实际应用中不断迭代优化。
CheckforAi
CheckforAi 是 Uphold.ai 推出的 AI 内容检测工具,用于识别文本内容是否由人工智能生成。结合 OpenAI 的 Roberta-base 模型和自身的专有模型,通过分析文本的语言特征,判断内容是否由 AI 生成。
Winston AI
Winston AI是专业的AI内容检测工具,能以99.98%的准确率识别由ChatGPT、GPT-4等语言模型生成的文本。支持多语言检测,能识别改写和人工处理的AI内容。
Copyleaks
Copyleaks是基于AI的抄袭检测工具,能识别和验证原创内容。支持100多种语言,适用于教育、出版、法律等多个领域,帮助用户检测文本、代码和图像中的抄袭行为。通过深度学习和自然语言处理技术,Copyleaks能识别语义相似性和复杂的剽窃形式。
Originality.AI
Originality.AI 是专为内容创作者、出版商和营销人员设计的综合平台,确保书面内容的原创性和完整性。提供了一系列工具,包括AI内容检测器、抄袭检测器和事实检查器,帮助用户验证内容是否由人工智能生成、是否存在抄袭以及内容的准确性。
AI Content Detector
AI Content Detector是Writer推出的免费的在线工具,帮助用户识别文本内容是否由人工智能生成。工具支持分析最多5,000个单词的文本,用户只需将文本粘贴到指定区域,可获得AI生成内容的概率评分。
团象
团象(原MitataAI)是AI内容检测与优化的平台。团象提供多种工具,如AIGC检测、降重和文本相似性检测等,帮助用户识别AI生成内容、降低文本重复率以及检测文本相似度。
挖错网
挖错网是AI内容审核校对平台,一键检测内容自动纠错,支持文本、图片、音频、视频等多种形式的内容审核。挖错网支持快速识别错别字、标点错误、语速问题、敏感词及涉政信息,提供高亮提示和纠错建议,保障内容的准确性和严谨性。
Sapling AI Content Detector
Sapling AI Content Detector 是检测文本是否由AI生成的免费在线工具,用户可以通过上传文本或直接粘贴内容进行检测,工具基于机器学习算法分析文本特征,识别出由 AI 模型(如 ChatGPT 和 GPT-4)生成的内容。
Smodin AI Content Detector
Smodin AI Content Detector是能区分人工编写内容和AI生成文本的高级工具。以91%的准确率识别AI文档,99%的准确率识别人类文档,帮助确保内容的真实性和原创性。工具支持多语言,包括英语和西班牙语等,用户界面友好,便于上传和扫描文档。
Writecream AI Content Detector
Writecream AI Content Detector 是专业的AI内容检测工具,能高效识别和区分AI生成的内容。基于深度学习和自然语言处理技术,为用户提供准确的检测报告,帮助避免版权纠纷,确保内容的原创性和质量。
Proofig
Proofig是一个检测科研图像是否造假或抄袭的AI工具,致力于通过先进的人工智能和计算机视觉技术,确保科研图像的真实性和完整性。该工具不仅保障了出版物的质量标准,同时也显著降低了因图像剽窃或篡改而导致的撤稿风险。
AISEO AI Content Detector
AISEO AI Content Detector 是由人工智能 SEO 文章工具 AISEO 推出的 AI 内容检测器,通过先进的算法来分析文本中的模式和结构并识别是由机器还是人类生成内容。该工具可以快速检测人工智能生成的内容,帮助文章创作者保持内容的质量和真实性。
StudyCorgi ChatGPT Detector
StudyCorgi ChatGPT Detector 是由在线论文数据库和平台 StudyCorgi 推出的免费的检测论文是否由 ChatGPT 生成的工具,该款 AI 论文检测器对学生和教师都是完全免费使用的。只需添加或输入要检测的文本内容,点击检查文字按钮即可获得关于文章是否由 AI 创建的可能性比例分析。
GPTZero
GPTZero是普林斯顿大学学生推出的AI内容检测工具,识别和分析输入的文本是否是由AI创建的,区分人类创作和人工智能生成的内容。工具支持句子、段落和文档级别的AI内容检测,通过分析文本的“困惑度”(即文本的复杂性和不可预测性)和“爆发性”(即句子结构和长度的变化程度)来判断文本来源。
朱雀AI检测
朱雀AI检测是腾讯推出的综合性 AI 内容检测助手,能精准识别 AI 生成的文本、图像和视频内容。朱雀AI检测支持检测多种主流模型,如 GPT-4、Claude、DeepSeek、Gemini、豆包等,能精准识别各类文本内容是否由 AI 生成。
PubMedQA
PubMedQA是专门用在生物医学研究问题回答的数据集。PubMedQA通过文献摘要回答“是/否/可能”形式的研究问题,例如“某种药物是否有效”。数据集包含1000个专家标注的问答实例、61200个未标注实例和211300个人工生成的问答对。
H2O EvalGPT
H2O EvalGPT,基于LLM的评估工具,H2O EvalGPT的概述与主要功能 H2O EvalGPT是H2O.ai推出的一款用于评估和比较大型语言模型(LLM)的开放工具。它提供了一个平台,帮助用户了解模型在大量任务和基准测试中的性能。无论是想使用大模型自动化工作流程或任务,H2O EvalGPT都可以提供流行、开源、高性能大模型的详细
LLMEval3
LLMEval是由复旦大学NLP实验室推出的大模型评测基准,最新的LLMEval-3聚焦于专业知识能力评测,涵盖哲学、经济学、法学、教育学、文学、历史学、理学、工学、农学、医学、军事学、管理学、艺术学等教育部划定的13个学科门类、50余个二级学科,共计约20W道标准生成式问答题目。
LMArena
LMArena是加州大学伯克利分校推出的创新AI模型评估平台,基于让用户对不同AI模型的回答进行匿名投票,衡量模型的表现。用户输入问题后,平台提供两个模型的回答,用户根据偏好选择更优答案,投票结果直接塑造公共排行榜。
MMBench
MMBench是多模态基准测试,由上海人工智能实验室、南洋理工大学、香港中文大学、新加坡国立大学和浙江大学的研究人员联合推出。MMBench推出一个综合评估流程,从感知到认知能力逐级细分评估,覆盖20项细粒度能力,从互联网与权威基准数据集采集约3000道单项选择题。
CMMLU
CMMLU是综合性的中文评估基准,专门用在评估语言模型在中文语境下的知识和推理能力,涵盖从基础学科到高级专业水平的67个主题。包括需要计算和推理的自然科学,需要知识的人文科学和社会科学,及需要生活常识的中国驾驶规则等。
OpenCompass
OpenCompass是上海人工智能实验室(上海AI实验室)于2023年8月正式推出的大模型开放评测体系,通过完整开源可复现的评测框架,支持大语言模型、多模态模型各类模型的一站式评测,并定期公布评测结果榜单。
AGI
AGI-Eval是上海交通大学、同济大学、华东师范大学、DataWhale等高校和机构合作发布的大模型评测社区,旨在打造公正、可信、科学、全面的评测生态,以“评测助力,让AI成为人类更好的伙伴”为使命。专门设计用于评估基础模型在人类认知和问题解决相关任务中的一般能力。
SuperCLUE
SuperCLUE 是针对中文大模型的综合性评测基准,能全面评估模型在多个维度上的性能表现。SuperCLUE 通过多轮对话、客观题测试等多种方式,从语言理解与生成、知识应用、专业技能、环境适应与安全性等四大能力象限的 12 项基础能力进行评估。
FlagEval
FlagEval(天秤)是北京智源人工智能研究院(BAAI)推出的科学、公正、开放的大模型评测体系及开放平台,为研究人员提供全面评估基础模型及训练算法性能的工具和方法。FlagEval采用“能力-任务-指标”三维评测框架,从多个维度对大模型的认知能力进行评估,涵盖对话、问答、情感分析等多种应用场景,提供超过22个数据集和8万道评测题目。
C
C-Eval是一个适用于大语言模型的多层次多学科中文评估套件,由上海交通大学、清华大学和爱丁堡大学研究人员在2023年5月份联合推出,包含了13948个多项选择题,涵盖了52个不同的学科和四个难度级别,用以评测大模型中文理解能力。
Open LLM Leaderboard
Open LLM Leaderboard 是最大的大模型和数据集社区 HuggingFace 推出的开源大模型排行榜单,基于 Eleuther AI Language Model Evaluation Harness(Eleuther AI语言模型评估框架)封装。
MMLU
MMLU 全称 Massive Multitask Language Understanding,是一种针对大模型的语言理解能力的测评,是目前最著名的大模型语义理解测评之一,由UC Berkeley大学的研究人员在2020年9月推出。
序列猴子:出门问问推出的一款超大规模的语言模型
序列猴子是出门问问推出的一款超大规模的语言模型,具有长序列、多模态、单模型、大数据等特点。利用其通用的表示能力与推理能力,用户能够进行多轮交互,从而在使用中获得更加便捷流畅的体验。
Cohere
Cohere是一个提供大语言模型的平台,帮助开发人员和企业构建高性能的AI产品。该平台主要提供AI驱动的搜索文本(多语言嵌入、神经搜索、搜索排名)、分类文本和生成文本等服务,可帮助企业快速部署对话式AI聊天机器人、生成式搜索引擎、文本摘要总结、增强向量检索等。
DeepFloyd IF:StabilityAI旗下的DeepFloyd团队推出的图片生成模型
DeepFloyd IF是由StabilityAI旗下的DeepFloyd研究团队推出的开源的文本到图像生成模型,IF是一个基于级联方法的模块化神经网络。
Gradio
Gradio是一个开源的Python库,用于构建演示机器学习或数据科学,以及web应用程序。用户可以使用Gradio基于自己的机器学习模型或数据科学工作流快速创建一个漂亮的用户界面,让用户可以尝试拖放他们自己的图像、粘贴文本、录制他们自己的声音,并通过浏览器与您的演示程序进行交互。
MiracleVision 奇想智能
MiracleVision奇想智能是由美图秀秀公司推出的自研AI视觉大模型,不仅具备高度的美学导向和图像处理能力,还能够广泛地应用于多个行业,提高工作流效率。