215℃Coze扣子推出AI分身功能,抖音创作者轻松打造虚拟形象

2025 年 2 月 19 日 Coze 扣子平台推 AI 分身功能,可创建个性化虚拟形象,多场景应用提互动效率,零代码支持搭智能应用,现处内测可申请体验。

99℃Claude 3.7 Sonnet:Anthropic 推出的新一代混合AI推理模型,重新定义AI能力

Claude 3.7 Sonnet 是 Anthropic 推出的新一代混合 AI 推理模型,具混合推理等核心亮点,应用于编程开发等多场景,运行成本不变,性价比高,标志 AI 技术新阶段。

84℃「捏 Ta」X「清影」战略合作:多模态模型商业化的新突破

清影与 “捏 Ta” 达成战略合作,基于共同目标,清影借智谱模型提供技术支持,“捏 Ta” 上线新功能且成绩亮眼,为用户带来高效低成本等价值,市场前景广,未来将继续探索创新。

100℃Agentic Reasoning – 牛津大学推出增强LLM推理能力的框架

Agentic Reasoning 由牛津大学开发,是增强 LLM 推理能力的框架,通过调用外部代理,具多种功能,靠独特技术原理支撑,应用于多领域,可从相关平台深入了解

117℃Aider:开源AI编程助手,助力高效代码开发

Aider 是开源的 AI 辅助编程工具,基于终端与 LLM 配合,支持多语言和多 LLM 对接,有代码编辑等多种功能,靠独特技术实现,应用场景广泛,可从官网和 GitHub 了解。

100℃AutoAgents:自然语言创建和部署LLM智能体的终极解决方案

AutoAgents 是基于 LLM 的自动智能体生成框架,能按目标生成智能体协作完成任务,具多种功能,应用于多领域,有简单使用方法,优势显著。

80℃CLaMP 3:清华大学推出的多模态音乐信息检索框架

CLaMP 3 由清华大学朱文武教授团队开发,是多模态多语言音乐信息检索框架,基于对比学习,具多种功能,靠独特技术支撑,应用于多领域,有丰富项目资源。

93℃DynamicCity:引领未来的4D动态场景生成框架

DynamicCity 是上海 AI Lab 开发的 4D 生成框架,专注生成具语义信息的动态 LiDAR 场景,具多种功能,基于 VAE 和 DiT 模型的独特技术原理,应用于多领域,可从多渠道了解。

122℃LLaDA:中国人民大学与蚂蚁集团联合推出的革命性扩散大语言模型

LLaDA 是中国人民大学高瓴 AI 学院与蚂蚁集团联合推出的扩散大语言模型,基于扩散模型框架,具多种核心优势与功能,靠独特技术支撑,应用于多领域,有丰富项目资源。

105℃Magma:微软研究院推出的多模态AI基础模型,重新定义AI能力边界

Magma 是微软研究院联合高校开发的多模态 AI 基础模型,能为智能代理提供通用能力,具多核心优势与技术创新,应用于多领域,有丰富项目资源,前景广阔。

81℃MoBA:Moonshot AI 提出的新型注意力机制,高效处理长文本的革命性技术

MoBA 是 Moonshot AI 推出的新型注意力机制,为提升大语言模型长上下文处理效率而设计,具多核心优势与功能,基于独特技术原理,应用于多领域,可从相关平台了解。

106℃Muse – 微软研究院推出的生成式AI模型:深度解析与应用前景

Muse 是微软研究院推出的游戏创意生成生成式 AI 模型,能模拟真实玩法,具多种功能,基于前沿技术,应用于多游戏场景,有丰富项目资源,前景广阔。

134℃Phantom:字节跳动 AI 框架,实现主体一致视频生成的创新解决方案

Phantom 是字节跳动智能创作团队开发的视频生成框架,基于跨模态对齐技术,具多种功能,靠独特技术支撑,应用于多领域,有丰富资源支持且优势显著。

81℃Qihoo-T2X:引领未来的高效多模态生成模型

Qihoo-T2X 是 360 AI 研究院与中山大学联合开发的多模态生成模型,基于 PT-DiT,具多种功能,靠独特技术支撑,应用于多领域,有相关项目资源,前景广阔。

89℃RSIDiff – 基于合成数据提升图像生成质量的递归自训练框架

RSIDiff 是基于合成数据的递归自训练框架,用于提升文本到图像扩散模型性能。通过独特的三种策略,解决生成质量、偏好对齐和模型稳定性问题,减少对大规模数据集依赖,在多领域应用前景广泛,可从 arXiv 论文了解其技术细节。

113℃Step-Audio-TTS-3B – 高性能 TTS 模型,助力多场景语音合成

Step-Audio-TTS-3B 是 Stepfun-AI 团队开发的高性能 TTS 模型,有 30 亿参数,具多语言、情感风格控制等功能,基于独特技术原理,应用于多领域,可在 HuggingFace 体验。

122℃SWE-Lancer:OpenAI 推出的革命性大模型基准测试工具

SWE-Lancer 是 OpenAI 推出的大模型基准测试工具,用真实软件工程任务评估语言模型,含多种功能,基于独特技术原理,应用于多领域,可从官网和仓库了解。

155℃ToddlerBot – 斯坦福大学开源的机器学习与人形机器人平台

ToddlerBot 是斯坦福大学开源的机器学习与人形机器人平台,为高效收集数据设计,具多种功能,基于数字孪生等技术,应用于多领域,有丰富项目资源。

180℃TongGeometry——引领几何 AI 的未来

TongGeometry 是北京通用人工智能研究院与北京大学联合开发的几何模型,能解决生成奥林匹克几何问题,具多种功能,基于创新技术,应用于多领域,有广阔未来展望。

103℃流畅阅读:一款强大的开源AI浏览器翻译插件

流畅阅读是基于 AI 的开源浏览器翻译插件,支持多翻译引擎,具智能翻译等多种功能,基于独特技术原理,应用于多场景,有项目官网和仓库。

74℃瑞智病理大模型 – 瑞金联合华为推出的多模态互动式病理大模型

瑞智病理大模型是瑞金医院与华为共同开发的多模态病理模型,通过多模态数据融合提升诊断,基于深度学习等技术,应用于多医疗场景,优势显著,前景广阔。

106℃Ovis2:阿里巴巴推出多模态大语言模型,解锁AI新可能

Ovis2 是阿里巴巴国际团队推出的多模态大语言模型,基于结构化嵌入对齐技术,有多种参数规模版本,具多模态理解等多种功能,靠独特技术支撑,应用于多领域,可从多平台获取。

108℃OSUM:西北工业大学开源的多任务语音理解模型,助力语音识别与情感分析

OSUM 是西北工业大学计算机学院相关研究组开发的开源语音理解模型,结合 Whisper 编码器与 Qwen2 LLM,基于 “ASR+X” 策略训练,支持语音识别、情感识别等多种任务,技术原理独特,应用场景广泛,可从多渠道获取使用。

123℃Crawl4LLM – 清华和卡内基梅隆大学联合开源的智能爬虫系统

Crawl4LLM 由清华和卡内基梅隆大学联合开发并开源,旨在提升 LLM 预训练效率,具多核心优势与功能,靠独特技术支撑,应用于多领域,可从多渠道获取信息。

147℃AI co-scientist – 谷歌推出多智能体协作的 AI 科研助手

AI co-scientist 是谷歌基于 Gemini 2.0 开发的多智能体协作系统,能模拟科研全流程,具多种功能,靠独特技术支撑,应用于多科研领域,可从多渠道了解体验。