大语言模型、AI 应用与工作流工具、AI 编程与绘画产品——涵盖 ChatGPT、Claude、Gemini、Cursor、Midjourney、Stable Diffusion 等。
AIOpenAI于2024年5月发布的全模态模型,原生支持文本、音频、图像的端到端处理,语音对话延迟降至约320毫秒,接近人类对话节奏,且比GPT-4 Turbo便宜50%。
AIGoogle Brain于2022年5月发布的文本到图像生成模型,在当时的基准测试FID和CLIP分数上超越DALL-E 2和Stable Diffusion,以其照片级真实感在学术界引发广泛关注,但长期未向公众开放。
AILM Studio 是一款图形界面的本地大语言模型运行工具,面向不熟悉命令行的用户,支持从 Hugging Face 直接搜索下载模型并在本地推理,自带类 ChatGPT 的对话界面和 OpenAI 兼容 API 服务器。
AIOpenAI于2022年9月开源的自动语音识别模型,以68万小时多语言音频训练,在绝大多数语言上达到甚至超越专业ASR服务的准确率,成为开源语音转文字的事实标准。
AIDeepMind开发的围棋AI,2016年以4:1击败世界冠军李世石,2017年以3:0击败排名世界第一的柯洁,终结了人类在围棋领域维持数十年的认知优越感,被视为AI史上的里程碑事件。
AIOpenAI开发的文本到图像生成模型系列,DALL-E 3于2023年10月整合进ChatGPT,支持精确的提示词理解和文字渲染,是OpenAI在视觉AI领域的核心产品。
AIStability AI于2023年11月开源的视频生成扩散模型,基于Stable Diffusion图像模型扩展而来,可从单张图片生成短视频,是开源视频生成领域的重要基础模型。
AI讯飞星火是科大讯飞推出的大语言模型产品,2023 年 5 月首发,依托讯飞在语音识别领域超过二十年的积累,在语音交互和教育场景中有显著优势,是国内最早通过教育行业垂直测评的 AI 助手之一。
AIGitHub与OpenAI联合推出的AI编程助手,2021年6月公测,基于Codex模型,能根据上下文自动补全代码、生成函数、写单元测试,是目前全球用户量最大的AI编程工具。
AIMiniMax 是 2021 年成立的中国 AI 公司,旗下包含文本大模型、语音合成和图像生成多条产品线,旗下「海螺 AI」以极度逼真的声音克隆和角色扮演对话著称,是中国最早将 RLHF 用于商业产品的公司之一。
AIPika 是 2023 年底快速走红的 AI 视频生成平台,由前斯坦福研究员创立,以极低门槛的图文转视频能力和病毒式传播的「Pikaffects」特效功能著称。
AIElevenLabs 是波兰裔创业者创立的 AI 语音合成平台,以极度逼真的克隆声音和多语言配音能力著称,2023 年成为增长最快的 AI 工具之一,同时也因深度伪造滥用引发广泛争议。
AI可灵是快手于 2024 年推出的 AI 视频生成模型,以支持 1080p 高清输出、最长 3 分钟视频和较强的物理世界模拟能力著称,是首批能较好处理人物运动连贯性的国产视频生成工具之一。
AIGoogle于2018年发布的双向预训练语言模型,确立预训练加微调范式,曾统治NLP各项基准。
AI由李飞飞团队构建的大规模图像数据库,其挑战赛 ILSVRC 直接引爆了深度学习革命。
AI通过人类偏好数据训练奖励模型、再用强化学习微调语言模型的技术方法,ChatGPT、Claude等主流AI产品的「有用、无害、诚实」特性很大程度上来自这套流程。
AI月之暗面科技(Moonshot AI)是 Kimi 助手背后的中国 AI 创业公司,由清华系研究员杨植麟创立,2024 年成为中国估值最高的 AI 初创之一,核心技术优势在于超长上下文语言模型。
AINotebookLM 是 Google 推出的 AI 笔记与研究辅助工具,允许用户上传自己的文档、PDF、网页作为「知识源」,让 AI 只基于这些材料回答问题和生成摘要,2024 年因播客生成功能引发大量关注。
AI智谱清言是北京智谱 AI 推出的 AI 助手,背靠清华大学技术基因,旗下 GLM 系列模型长期是国内学术圈和工程师群体常用的开源基座模型,GLM-4 于 2024 年对标 GPT-4 水平。
AIGoogle提出的文本到文本统一框架,把所有NLP任务都转化为序列生成,编码器-解码器架构代表。