12月份马上结束,2023年也即将过去,在这里给大家盘点一下2023值得收藏的Ai神器,争取2024年里更好的运用他们哦。
一、AI 聊天机器人
过去 一 年是大语言模型发展的井喷之年,但是说起目前最强大的 AI 聊天机器人,却依旧是 1 年前横空出世的 ChatGPT。ChatGPT 的目前内置的是 GPT-4V 多模态模型,可以处理图像、音频等多种类型的信息,性能也比之前的 GPT-3.5 要好。今年 ChatGPT 还出了手机 APP,可以实现语音交互,支持中英等多种语言,对用户来说使用更便捷。

ChatGPT 还在今年推出了插件(Plugins)功能,赋予其使用工具、联网、运行计算的能力,让 ChatGPT 的能力有了进一步的扩大和提升。而 11 月份推出的 GPTs 则更进一步,让用户能够按需要定制 AI 工具来辅助自己完成任务。GPTs 还可以互相分享,我们可以直接使用别人构建好的 AI 工具,目前也有很多 GPTs 资源网站可以使用。

Google Bard 目前内置了最新的原生多模态大模型 Gemini Pro,这是谷歌历史上最强大、最通用的模型,可以吸收任何类型的输入和输出,包括文本、代码、视频、音频和图像。对我们普通用户来说,Bard 的获取便捷度要比 ChatGPT 好很多,还是免费的,作为 ChatGPT 的平替来使用非常不错。

3、文心一言
百度在今年 10 月份的时候发布了文心大模型 4.0,与原来的基础模型相比在理解、生成、逻辑和记忆能力上都有着显著提升,并且也有插件功能。“一言百宝箱”中有很多 AI 小工具,可以帮用户直接解决各种类型的问题,而像考公资料、写教案、写党政报道这样的特色功能则只有中文大语言模型里才能找到,这也是国产模型相比国外模型的优势。

Copilot 其实就是之前的微软 New Bing Chat,今年 11 月份改为了 Copilot。它目前依旧集成在 Edge 浏览器中,内置的是 GPT-4 模型,并支持调用 DALL·E 3 生成图像。当我们在浏览器搜索框内输入问题进行搜索后,AI 自动总结好的好答案,鼠标滚轮上划能看完整内容和信息的来源,还能切换不同的模式与 AI 进行对话,日常用来查找信息非常方便。

5、Perplexity
问 AI 聊天机器人问题时,我们最担心的一点就是它会“胡编乱造”,给我们错误的信息,而 Perplexity AI 可以解决这个问题。
Perplexity 准确来说是一个 AI 驱动的搜索引擎,利用 GPT-4 模型,综合最新的信息(包括新闻、学术、视频等)为用户提供准确、权威的答案,并且还会附上答案的引用源,方便用户检验信息是否正确,还支持识别图像和上传文档。它的界面设计非常简洁,交互高效并具有成沉浸感,月访问量曾一度跻身所有网页 AI 应用的前 10,仅次于 Midjourney 和 Huggingface。

二、AI 音视频工具
Runway 无疑是目前最强的视频生成和编辑应用,它既有正常的视频剪辑功能,也有基于生成式 AI 的各项新功能,包括文生图、图生图、文生视频、图生视频、视频风格化、文本生成语音、一键视频抠图、视频内容抹除、动态追踪等。
用 Runway 的 Gen-2 模型生成视频时,可以调节视频运动幅度,可以设置不同的镜头运动方式,还支持用运动笔刷控制画面中的运动区域,以及视频进行抠图然后组合生成新的场景,这都让视频生成的可控性变得更强了。
Pika 算是 AI 视频生成领域的后起之秀,它也支持通过文本或者图像生成视频,也可以控制视频动态强度和镜头运动方式,总体来说和 Runway 非常类似。最新的 Pika 1.0 则是让它的功能更上一层楼,不但可以生成高质量的 2D/3D 动画,还支持视频扩展(Expand canvas)和区域修改(Modify region),让 AI 视频的趣味性变得更强了。
Domo AI 是最近才出现的一个 AI 视频生成应用,功能包括文生图、图像风格转化、图像生成视频和视频风格转换。由于它将真人视频转化为动漫、3D、像素等风格时非常稳定,效果比目前其他的 AI 视频工具都优秀,所以非常受欢迎。
前段时间郭德纲用英语说相声的视频让 Heygen 爆火出圈,作为一个数字人视频生成工具,Heygen 不仅有可以在神态上以假乱真的数字人形象,还提供了从人物选择、内容制作到配音、视频合成等一整套的服务,让营销视频的制作变得前所有的简单和高效。视频对口型无痕翻译则是其新推出的功能,给传统视频翻译和影视制作带来了一种新的处理思路。
Rephrase Studio 是一个文本到视频生成平台,可消除视频制作的复杂性,使您能够在几分钟内使用数字化身创建具有专业外观的视频。

一帧秒创是基于新壹视频大模型以及一帧AIGC智能引擎内容生成平台,为创作者和机构提供AI生成服务,包括文字续写、文字转语音、文生图、图文转视频等创作服务,一帧秒创通过对文案、素材、AI语音、字幕等进行智能分析,快速成片,零门槛创作视频。

1、Stable Diffusion WebUI / Fooocus / ComfyUI
去年的 12 月份时 Midjourney 已经是 V4 模型了,图像生成质量和清晰度大幅提升,一跃成为当时最受瞩目的 AI 绘画工具,而 Stable Diffusion 还处于 v2.1 版本,图像生成效果并不好。时隔一年,现在 Stable Diffusion 的出图质量与 Midjourney 已经没有那么大的差距了,这主要得益于 Dreambooth/ Lora 这些技术的出现,还有就是新模型 Stable Diffusion XL 1.0 的发布。
过去的一年里 Stable Diffusion 的生态也进一步发展完善,高质量的开源模型不断涌现,我们可以选择的图像风格越来越丰富;开源插件更是极大地拓宽了 Stable Diffusion 的能力,提高了图像生成的可控性和处理效率,让其成为目前平面、建筑、游戏等设计领域的首选 AI 工具。

Midjourney 今年的更新升级也非常密集,推出过 V5、V5.1、V5.2、Niji 5 等版本,让其图像生成质量始终处理领先地位;也接连上线了 Zoom out 图像拓展外绘、High Variation 高变体、Describe 图像描述、Shorten 提示词优化、Vary Region 局部重绘、Styler Tuner 风格生成器等功能,满足用户编辑图像和探索风格的需求。
Stable Diffusion XL 1.0、Dalle 3 还有各种新的 AI 绘画工具的接连出现也一度给了 Midjourney 不小的压力,不过前几天它又推出了新的 V6 版本,图像的细节精细度达到令人惊叹的水平,对提示词的理解也更准确,还支持生成正确的英文文本内容,这让 Midjourney 在 AI 绘画领域依旧非常有竞争力。

3、Adobe Firefly / PS beta
Adobe 在 4 月份的时候推出了自己的 AI 图像生成模型 Firefly,支持文生图、文生字体特效、局部重绘等多种功能,还将这些功能置入到了 Photoshop Beta 测试版中,让设计师可以借助 AI 的力量更高效地完成设计工作。
10 月份的时候 Firefly Image Model 升级到了 2.0 版本,图像生成质量比之前有了进一步提升,还支持人像调节、垫图、镜头调色设置等多种功能,还有 Firefly Vector Model,支持通过文字生成矢量图像,相信未来 Adobe 旗下的工具肯定会在 AI 的加持下更加好用。

这期盘点到这里,期待2024年AI工具的更新迭代,祝各位同学2024年能够熟练运用这些工具提升自己的效率哦
喜欢小编的同学们记得关注下哦