一些好用的AI推荐
此文为本人2024年初(高一上)语文课前演讲搞,内容已经过时,且本人当时认知有限,请不要把本文作为任何参考
一些好用的AI推荐
部分需要梯的我会标注
D18 21 张霆希
声明
大模型现在的测试标准非常多,所以很多说超越GPT-4的可能只是某个方面。以下内容仅为个人主观观点,并不参考某单一标准。
图片内容:大模型主流基准测试的环形树状图,展示了推理(Reasoning)、理解(Understanding)、知识(Knowledge)、语言(Language)、考试(Exams)五大能力维度及对应的测试集名称,用于说明当前AI模型评测的复杂性。
一、GPT 系列
GPT-3.5
- GPT-3.5为最初版本的ChatGPT,翻出去后可以直接注册使用(大陆手机号无法注册,可以用Google邮箱注册)
- 网址:https://chat.openai.com
- 目前实力已经被其他AI超越,没有特地使用必要
图片内容:
- ChatGPT网页界面截图,显示ChatGPT的Logo、"How can I help you today?"标题及4个提示建议卡片
- GPT-3.5模型选择器的下拉元素,显示模型版本选项
GPT-4 & Copilot
- GPT-4在OpenAI官网上需要氪金,没钱,怎么办?
- New Bing支持Copilot了!
图片内容:
- New Bing/Copilot界面截图,展示搜索与AI对话的整合体验
- Copilot图标/入口的展示
Microsoft & Copilot
- 关于微软投资OpenAI 100亿的事情相信大家都听说过,这里就不细说了
- 直接说使用方法:翻出去后直接打开bing官网,登录自己的Microsoft账号即可使用
- 可以自由调节模式:More Creative / More Balanced / More Precise 三种对话风格可选
- 以下是一个例子:我询问Copilot:“我是一个信息学竞赛生,我不想学信竞了。你觉得化学竞赛和生物竞赛哪个适合我?”
- 可以看出,回答非常有逻辑,还附有参考链接
图片内容:
- Microsoft Copilot对话界面截图,含SEARCH/COPILOT/NOTEBOOK标签
- Copilot对话风格选择器截图,显示"More Creative / More Balanced(选中) / More Precise"三个选项
- Copilot中文回答截图,展示对化学竞赛与生物竞赛对比分析的回答,回答结构清晰、附有参考链接
二、Sora
- 目前只针对部分科学家和艺术家开放,普通人想用到Sora不知道要什么时候了
- 所以这里就聊一下八卦
- 不同的大佬对Sora的看法是怎样的?如果Sora未来开放公测,会对我们有什么影响?
图片内容:
- Sora生成的示例视频截图:东京雨夜街道上女性行走的AI生成画面(Sora最经典的demo)
- 静态画面 + GIF动画展示Sora的视频生成效果
各界大佬对Sora/AGI的看法
AGI指通用人工智能
| 人物 | 身份 | 观点 |
|---|---|---|
| 杨立昆 | Meta首席AI科学家 | 不太看好Sora,认为抽象表示在AI中更重要 |
| Google科学家 | - | 对Sora持审慎态度 |
| 周鸿祎 | 360总裁 | 表示支持,认为"Sora意味着AGI实现将从10年缩短到两三年" |
| 马斯克 | - | 认为人类完蛋了(“gg humans”) |
图片内容:
- 周鸿祎的微博截图,内容为关于Sora与AGI时间线的观点
- Yann LeCun与Kevin Murphy的Twitter对话截图,讨论Sora与抽象表示在AI中的作用
- Elon Musk的X帖子截图,配图为Sora生成的东京雨夜街道女性视频,文案为"gg humans"
- Copilot对AGI的解释截图
三、Google Gemini
图片内容:
- Google AI进展时间轴中文信息图,涵盖2023年12月至2024年2月Gemini系列关键节点(Gemini Ultra/Pro/Nano发布等)
- Gemini生成的示例图片:
- 西部片风格的拓荒小镇场景(含木质建筑、骑马人物、溪流与山丘背景)
- 女性时尚街拍(含黑色皮夹克、酒红色连衣裙、墨镜及东京霓虹夜景背景)
Google的种族偏见
图片内容:展示了Google Gemini在图片生成中的种族偏见问题相关截图,这是当时引发热议的争议事件
四、Tesla Grok
- 本PPT制作时Grok还没公开测试,所以关于Grok的关注并不多
图片内容:
- Meme风格图片:长廊两侧超级英雄向中央xAI Grok标志鞠躬;中央有Grok Logo,下方黄底黑字"本周将开源Grok"
- 两侧角色旁标注多个中国AI公司Logo(通义千问、智源悟道、360智脑、天工、讯飞星火、智元兔、OpenBMB、商量、WeLM、文心一言等)
- 整体表达中国各大AI模型对Grok开源的关注与重视
- PS:这张图当时还没开源
五、Nvidia投资:Perplexity AI
- Perplexity AI获得Nvidia投资
图片内容:Perplexity AI的界面截图或相关投资新闻报道
六、Grop
图片内容:Grop相关介绍或演示截图(疑为Grok的笔误或早期写法)
七、国内AI
国内也有很多优秀的AI,而且不需要墙
中国四大AI
- 百度文心一言
- 科大讯飞星火
- 阿里通义千问
- 字节跳动豆包
图片内容:幻灯片中出现"中国AI领军人物李一舟"的相关图片
中国对AI发展贡献巨大
图片内容:
- 中国AI产业发展相关数据图表、发展里程碑或代表性产品截图
- 展示中国在AI领域的重要贡献
百度文心一言
- 严格意义上国内最早的生成式大模型
- 印象中是去年3、4月推出的
- 国内使用最广泛的AI了
- 直接访问:https://yiyan.baidu.com/
图片内容:文心一言的对话界面截图及网上使用示例
文心一言的Bug与能力
- 现在人家把Bug修好了,但换个问题估计又不行了
- 可以看出数学与作图能力还是不错的
图片内容:
- 文心一言Bug修复前后的对比截图或模型输出样例
- 文心一言数学计算与绘图能力的演示截图
文心一言4.0
- 要氪金,我没用过,可以看看新闻
图片内容:
- 文心一言4.0相关新闻报道截图,涉及价格、会员或企业版介绍
阿里通义千问
- https://tongyi.aliyun.com/qianwen/
- 用起来感觉差不多
- 相比文心一言还是差点,更别说GPT了
图片内容:通义千问对话界面截图
科大讯飞星火
- 中文识别能力在国内还是领先
- https://xinghuo.xfyun.cn/
- 有很多很多插件
图片内容:讯飞星火界面截图,展示丰富的插件列表
字节跳动豆包
- https://www.doubao.com
- 可能是因为抖音的存在,图片制作很精美,而且有很多插件是为做视频而服务的
- 视频创作+AI肯定是当下热门的潮流
图片内容:
- 豆包产品界面截图,展示其图像生成和视频相关功能
- "豆包"图片制作精美!展示豆包生成的高质量图像作品
八、国内非主流AI
AI不仅是大厂在研究,很多国内新兴的企业也在研究,而且各有其优点
海螺问问
- https://hailuoai.com/chat
- 上海稀宇科技有限公司(MiniMax)开发
- 公司估值20亿美元,融资达2.5亿美元
- 目前只有APP,差评
- 支持30秒的样本让用户克隆自己的声音
图片内容:海螺问问界面截图或语音克隆效果示例
Kimi Chat
- https://kimi.moonshot.cn/
- 月之暗面开发
- 目前估值7亿美元,融资达20亿人民币
- 可支持20万汉字上下文处理
图片内容:Kimi Chat对话界面截图,展示长文档处理能力
百川大模型
- https://www.baichuan-ai.com
- 公司估值18亿美元,融资达3亿美元
- 在中文通用能力测评(CMMLU、GAOKAO、AGI-Eval)上超越GPT-4
- 界面有点简陋(侧边栏好大)
图片内容:
- 百川大模型界面截图(界面简陋,侧边栏较大)
- 评测成绩对比图或模型输出样例
智谱清言
- https://chatglm.cn/
- 公司估值140亿人民币,融资达25亿人民币
- 清华背景,自研算法框架,对应开源模型在Github受好评
- 反正光环很多
图片内容:智谱清言界面截图,可能包含清华相关标识或模型能力介绍
九、国内AI——图片生成AI
- AI生成图功能基本上被整合了,但还有很多是专门给图片的
- 大厂:百度的文心一格、阿里的通义万相、抖音的Dreamina、商汤科技的秒画
- 画家出身:美图秀秀的WHEE、素材大户千库网的无限画
图片生成效果展示
总体而言还行:
| AI名称 | 说明 |
|---|---|
| 文心一格 | 百度旗下图片生成AI |
| 通义万相 | 阿里旗下图片生成AI |
| Dreamina | 抖音旗下图片生成AI |
| 秒画 | 商汤科技旗下图片生成AI |
图片内容:四款AI图片生成工具的效果展示截图,展示各自生成的图片样例
十、国内AI——视频生成AI
国内有没有视频生成类呢?像Sora那种长视频的是没有的
目前有两类主要的视频生成类:
- 根据文案搜索视频
- 几秒的视频制作
这两种我都玩过,但是我做的视频惨不忍睹,就不放出来丢人现眼了,给大家看看网上别人的例子。
度加创作
- 嗯,又是百度的
- 原理是根据脚本生成配音,并把素材剪辑到一起
- https://aigc.baidu.com/home
图片内容:GIF动画展示度加创作的视频生成效果
即创
- 抖音系列的,但是多了个数字人功能
- https://aic.oceanengine.com/
- 它的海外版CapCut AI Video以稳定的表现和良好的成像质量排名第一
图片内容:
- GIF动画展示即创的视频生成效果
- CapCut AI Video的相关截图
8款国产AI视频生成对比
- 这里还有8款国产AI生成类似Sora中女子走街头的画面,还是可圈可点的
- 当然,它们只能生成这种几秒的视频
- 国产AI想达到Sora的水平还是任重道远
- 里面有一些开放公测的,可以去用一下
图片内容:GIF动画展示多款国产AI视频生成工具生成的"女子走街头"画面
具体视频AI工具
| 工具名 | 说明 |
|---|---|
| Pixeling | 国产视频生成AI |
| NeverEnds | 国产视频生成AI |
| Vega AI | 国产视频生成AI |
| 艺映AI | 国产视频生成AI |
图片内容:GIF动画分别展示Pixeling、NeverEnds、Vega AI、艺映AI的视频生成效果
个人尝试
- Eg:生成一个正在跳舞的女孩
- 我自己尝试生成的一个视频(只能4秒)
十一、音乐生成类AI
- 网易云天音(果然音乐软件就做音乐AI),可以一键输入灵感来创作
- 可惜目前只对白名单用户使用
- 国内目前开放公测的只有BGM猫
图片内容:BGM猫的界面截图
十二、AI时代已经在我们身边
- 这份PPT主要介绍的是生成式大模型,但非生成式的AI已经在很久之前已经使用了。比如人脸识别
- AI的落地将会很快实现
- 虽然现在还没出现创新型的应用,但是已经有很多尝试性的创新了
图片内容:
- AI在日常生活各领域的应用场景展示
- 阿里迎春AI相关截图(过年期间的AI互动体验)
- 2022年深圳公司装监控回看程序员读写代码的新闻截图
- 网络安全相关图片:“如果互联网是一把枪,那网络攻击就是原子弹”
- 安全/监控/AI治理相关的新闻报道截图
以上内容整理自演讲PPT《一些好用的AI推荐》,涵盖PPT中所有文字内容及图片核心信息的文字化概括。

