PromptPilot
PromptPilot 是火山方舟推出的AI提示词解决方案平台,能优化大语言模型的输入指令(Prompt)。平台通过智能算法,将用户的任务描述转化为高效的 Prompt 方案,在实际应用中不断迭代优化。
CheckforAi
CheckforAi 是 Uphold.ai 推出的 AI 内容检测工具,用于识别文本内容是否由人工智能生成。结合 OpenAI 的 Roberta-base 模型和自身的专有模型,通过分析文本的语言特征,判断内容是否由 AI 生成。
Winston AI
Winston AI是专业的AI内容检测工具,能以99.98%的准确率识别由ChatGPT、GPT-4等语言模型生成的文本。支持多语言检测,能识别改写和人工处理的AI内容。
Copyleaks
Copyleaks是基于AI的抄袭检测工具,能识别和验证原创内容。支持100多种语言,适用于教育、出版、法律等多个领域,帮助用户检测文本、代码和图像中的抄袭行为。通过深度学习和自然语言处理技术,Copyleaks能识别语义相似性和复杂的剽窃形式。
Originality.AI
Originality.AI 是专为内容创作者、出版商和营销人员设计的综合平台,确保书面内容的原创性和完整性。提供了一系列工具,包括AI内容检测器、抄袭检测器和事实检查器,帮助用户验证内容是否由人工智能生成、是否存在抄袭以及内容的准确性。
AI Content Detector
AI Content Detector是Writer推出的免费的在线工具,帮助用户识别文本内容是否由人工智能生成。工具支持分析最多5,000个单词的文本,用户只需将文本粘贴到指定区域,可获得AI生成内容的概率评分。
团象
团象(原MitataAI)是AI内容检测与优化的平台。团象提供多种工具,如AIGC检测、降重和文本相似性检测等,帮助用户识别AI生成内容、降低文本重复率以及检测文本相似度。
挖错网
挖错网是AI内容审核校对平台,一键检测内容自动纠错,支持文本、图片、音频、视频等多种形式的内容审核。挖错网支持快速识别错别字、标点错误、语速问题、敏感词及涉政信息,提供高亮提示和纠错建议,保障内容的准确性和严谨性。
Sapling AI Content Detector
Sapling AI Content Detector 是检测文本是否由AI生成的免费在线工具,用户可以通过上传文本或直接粘贴内容进行检测,工具基于机器学习算法分析文本特征,识别出由 AI 模型(如 ChatGPT 和 GPT-4)生成的内容。
Smodin AI Content Detector
Smodin AI Content Detector是能区分人工编写内容和AI生成文本的高级工具。以91%的准确率识别AI文档,99%的准确率识别人类文档,帮助确保内容的真实性和原创性。工具支持多语言,包括英语和西班牙语等,用户界面友好,便于上传和扫描文档。
Writecream AI Content Detector
Writecream AI Content Detector 是专业的AI内容检测工具,能高效识别和区分AI生成的内容。基于深度学习和自然语言处理技术,为用户提供准确的检测报告,帮助避免版权纠纷,确保内容的原创性和质量。
Proofig
Proofig是一个检测科研图像是否造假或抄袭的AI工具,致力于通过先进的人工智能和计算机视觉技术,确保科研图像的真实性和完整性。该工具不仅保障了出版物的质量标准,同时也显著降低了因图像剽窃或篡改而导致的撤稿风险。
AISEO AI Content Detector
AISEO AI Content Detector 是由人工智能 SEO 文章工具 AISEO 推出的 AI 内容检测器,通过先进的算法来分析文本中的模式和结构并识别是由机器还是人类生成内容。该工具可以快速检测人工智能生成的内容,帮助文章创作者保持内容的质量和真实性。
StudyCorgi ChatGPT Detector
StudyCorgi ChatGPT Detector 是由在线论文数据库和平台 StudyCorgi 推出的免费的检测论文是否由 ChatGPT 生成的工具,该款 AI 论文检测器对学生和教师都是完全免费使用的。只需添加或输入要检测的文本内容,点击检查文字按钮即可获得关于文章是否由 AI 创建的可能性比例分析。
GPTZero
GPTZero是普林斯顿大学学生推出的AI内容检测工具,识别和分析输入的文本是否是由AI创建的,区分人类创作和人工智能生成的内容。工具支持句子、段落和文档级别的AI内容检测,通过分析文本的“困惑度”(即文本的复杂性和不可预测性)和“爆发性”(即句子结构和长度的变化程度)来判断文本来源。
朱雀AI检测
朱雀AI检测是腾讯推出的综合性 AI 内容检测助手,能精准识别 AI 生成的文本、图像和视频内容。朱雀AI检测支持检测多种主流模型,如 GPT-4、Claude、DeepSeek、Gemini、豆包等,能精准识别各类文本内容是否由 AI 生成。
PubMedQA
PubMedQA是专门用在生物医学研究问题回答的数据集。PubMedQA通过文献摘要回答“是/否/可能”形式的研究问题,例如“某种药物是否有效”。数据集包含1000个专家标注的问答实例、61200个未标注实例和211300个人工生成的问答对。
H2O EvalGPT
H2O EvalGPT,基于LLM的评估工具,H2O EvalGPT的概述与主要功能 H2O EvalGPT是H2O.ai推出的一款用于评估和比较大型语言模型(LLM)的开放工具。它提供了一个平台,帮助用户了解模型在大量任务和基准测试中的性能。无论是想使用大模型自动化工作流程或任务,H2O EvalGPT都可以提供流行、开源、高性能大模型的详细
LLMEval3
LLMEval是由复旦大学NLP实验室推出的大模型评测基准,最新的LLMEval-3聚焦于专业知识能力评测,涵盖哲学、经济学、法学、教育学、文学、历史学、理学、工学、农学、医学、军事学、管理学、艺术学等教育部划定的13个学科门类、50余个二级学科,共计约20W道标准生成式问答题目。
LMArena
LMArena是加州大学伯克利分校推出的创新AI模型评估平台,基于让用户对不同AI模型的回答进行匿名投票,衡量模型的表现。用户输入问题后,平台提供两个模型的回答,用户根据偏好选择更优答案,投票结果直接塑造公共排行榜。
MMBench
MMBench是多模态基准测试,由上海人工智能实验室、南洋理工大学、香港中文大学、新加坡国立大学和浙江大学的研究人员联合推出。MMBench推出一个综合评估流程,从感知到认知能力逐级细分评估,覆盖20项细粒度能力,从互联网与权威基准数据集采集约3000道单项选择题。
CMMLU
CMMLU是综合性的中文评估基准,专门用在评估语言模型在中文语境下的知识和推理能力,涵盖从基础学科到高级专业水平的67个主题。包括需要计算和推理的自然科学,需要知识的人文科学和社会科学,及需要生活常识的中国驾驶规则等。
OpenCompass
OpenCompass是上海人工智能实验室(上海AI实验室)于2023年8月正式推出的大模型开放评测体系,通过完整开源可复现的评测框架,支持大语言模型、多模态模型各类模型的一站式评测,并定期公布评测结果榜单。
AGI
AGI-Eval是上海交通大学、同济大学、华东师范大学、DataWhale等高校和机构合作发布的大模型评测社区,旨在打造公正、可信、科学、全面的评测生态,以“评测助力,让AI成为人类更好的伙伴”为使命。专门设计用于评估基础模型在人类认知和问题解决相关任务中的一般能力。
SuperCLUE
SuperCLUE 是针对中文大模型的综合性评测基准,能全面评估模型在多个维度上的性能表现。SuperCLUE 通过多轮对话、客观题测试等多种方式,从语言理解与生成、知识应用、专业技能、环境适应与安全性等四大能力象限的 12 项基础能力进行评估。
FlagEval
FlagEval(天秤)是北京智源人工智能研究院(BAAI)推出的科学、公正、开放的大模型评测体系及开放平台,为研究人员提供全面评估基础模型及训练算法性能的工具和方法。FlagEval采用“能力-任务-指标”三维评测框架,从多个维度对大模型的认知能力进行评估,涵盖对话、问答、情感分析等多种应用场景,提供超过22个数据集和8万道评测题目。
C
C-Eval是一个适用于大语言模型的多层次多学科中文评估套件,由上海交通大学、清华大学和爱丁堡大学研究人员在2023年5月份联合推出,包含了13948个多项选择题,涵盖了52个不同的学科和四个难度级别,用以评测大模型中文理解能力。
Open LLM Leaderboard
Open LLM Leaderboard 是最大的大模型和数据集社区 HuggingFace 推出的开源大模型排行榜单,基于 Eleuther AI Language Model Evaluation Harness(Eleuther AI语言模型评估框架)封装。
MMLU
MMLU 全称 Massive Multitask Language Understanding,是一种针对大模型的语言理解能力的测评,是目前最著名的大模型语义理解测评之一,由UC Berkeley大学的研究人员在2020年9月推出。
序列猴子:出门问问推出的一款超大规模的语言模型
序列猴子是出门问问推出的一款超大规模的语言模型,具有长序列、多模态、单模型、大数据等特点。利用其通用的表示能力与推理能力,用户能够进行多轮交互,从而在使用中获得更加便捷流畅的体验。
Cohere
Cohere是一个提供大语言模型的平台,帮助开发人员和企业构建高性能的AI产品。该平台主要提供AI驱动的搜索文本(多语言嵌入、神经搜索、搜索排名)、分类文本和生成文本等服务,可帮助企业快速部署对话式AI聊天机器人、生成式搜索引擎、文本摘要总结、增强向量检索等。
DeepFloyd IF:StabilityAI旗下的DeepFloyd团队推出的图片生成模型
DeepFloyd IF是由StabilityAI旗下的DeepFloyd研究团队推出的开源的文本到图像生成模型,IF是一个基于级联方法的模块化神经网络。
Gradio
Gradio是一个开源的Python库,用于构建演示机器学习或数据科学,以及web应用程序。用户可以使用Gradio基于自己的机器学习模型或数据科学工作流快速创建一个漂亮的用户界面,让用户可以尝试拖放他们自己的图像、粘贴文本、录制他们自己的声音,并通过浏览器与您的演示程序进行交互。
MiracleVision 奇想智能
MiracleVision奇想智能是由美图秀秀公司推出的自研AI视觉大模型,不仅具备高度的美学导向和图像处理能力,还能够广泛地应用于多个行业,提高工作流效率。
悟道
2021年6月,北京智源研究院(BAAI)推出了悟道1.0的后续版本悟道2.0,作为中国第一个超大规模智能模型系统。悟道是一个语言模型,旨在在人类层面的思维上超越 OpenAI 的 GPT-3 和谷歌的 LaMDA。
GPT
GPT-4(Generative Pre-trained Transformer)是 OpenAI 开发的自然语言处理模型 GPT 家族中的第四个版本,该模型依靠强大的神经网络来理解和生成类似人类的语言。
腾讯混元大模型
腾讯混元是腾讯公司推出的多功能大语言模型,具备强大的自然语言处理和生成能力。支持多种应用场景,如对话交互、视觉生成、代码辅助、文档编辑、知识问答等,能帮助用户高效完成任务并提升内容创作效率。
Gemma
Gemma是由谷歌DeepMind和谷歌的其他团队开发的一系列轻量级、先进的开放AI模型,基于与Gemini模型相同的技术,旨在帮助开发者和研究人员构建负责任的AI应用。Gemma模型系列包括两种权重规模的模型:Gemma 2B 和 Gemma 7B,提供预训练和指令微调版本,支持多种框架,如JAX、PyTorch和TensorFlow,以在不同设备上高效运行。
AgentGPT
AgentGPT 是能在浏览器中运行的自主人工智能工具。用户通过设定目标(如创建报告、规划旅行或制定学习计划等),AgentGPT 自动思考任务、执行并从结果中学习,以达成目标。AgentGPT 支持自定义目标,具备强大的灵活性和自主性。
Jan(Jan.ai)
Jan(Jan.ai)是一个免费开源的本地运行大模型并进行AI聊天对话的工具,可帮助用户在本地电脑(Windows、Mac、Linux)上安装、部署、运行并使用开源版本的ChatGPT替代大模型,如LLaMa、Mistral、Phi-2等20多个模型,也支持输入自己的OpenAI API Key以运行GPT。
无阶未来
无阶未来是AI应用与弹性算网平台,专注于为用户提供强大的算力支持和丰富的AI应用服务。无阶未来提供多种类型的显卡资源,用户可以根据需求选择合适的资源进行AI应用的训练和部署
豆包大模型
豆包大模型是字节跳动推出的AI大模型家族,包括 豆包PixelDance、豆包Seaweed 视频生成、文生图、图生图、同声传译、角色扮演、语音合成、声音复刻、语音识别、Function Call和向量化等多个模型。豆包大模型具备强大的语言理解、生成和逻辑能力,能进行个性化创作、情绪丰富的语音合成、高精度语音识别、多风格图像生成和顶级的视频生成。