此文为本人2024年初(高一上)语文课前演讲搞,内容已经过时,且本人当时认知有限,请不要把本文作为任何参考

一些好用的AI推荐

部分需要梯的我会标注

D18 21 张霆希


声明

大模型现在的测试标准非常多,所以很多说超越GPT-4的可能只是某个方面。以下内容仅为个人主观观点,并不参考某单一标准。

图片内容:大模型主流基准测试的环形树状图,展示了推理(Reasoning)、理解(Understanding)、知识(Knowledge)、语言(Language)、考试(Exams)五大能力维度及对应的测试集名称,用于说明当前AI模型评测的复杂性。


一、GPT 系列

GPT-3.5

  • GPT-3.5为最初版本的ChatGPT,翻出去后可以直接注册使用(大陆手机号无法注册,可以用Google邮箱注册)
  • 网址:https://chat.openai.com
  • 目前实力已经被其他AI超越,没有特地使用必要

图片内容

  • ChatGPT网页界面截图,显示ChatGPT的Logo、"How can I help you today?"标题及4个提示建议卡片
  • GPT-3.5模型选择器的下拉元素,显示模型版本选项

GPT-4 & Copilot

  • GPT-4在OpenAI官网上需要氪金,没钱,怎么办?
  • New Bing支持Copilot了!

图片内容

  • New Bing/Copilot界面截图,展示搜索与AI对话的整合体验
  • Copilot图标/入口的展示

Microsoft & Copilot

  • 关于微软投资OpenAI 100亿的事情相信大家都听说过,这里就不细说了
  • 直接说使用方法:翻出去后直接打开bing官网,登录自己的Microsoft账号即可使用
  • 可以自由调节模式:More Creative / More Balanced / More Precise 三种对话风格可选
  • 以下是一个例子:我询问Copilot:“我是一个信息学竞赛生,我不想学信竞了。你觉得化学竞赛和生物竞赛哪个适合我?”
  • 可以看出,回答非常有逻辑,还附有参考链接

图片内容

  • Microsoft Copilot对话界面截图,含SEARCH/COPILOT/NOTEBOOK标签
  • Copilot对话风格选择器截图,显示"More Creative / More Balanced(选中) / More Precise"三个选项
  • Copilot中文回答截图,展示对化学竞赛与生物竞赛对比分析的回答,回答结构清晰、附有参考链接

二、Sora

  • 目前只针对部分科学家和艺术家开放,普通人想用到Sora不知道要什么时候了
  • 所以这里就聊一下八卦
  • 不同的大佬对Sora的看法是怎样的?如果Sora未来开放公测,会对我们有什么影响?

图片内容

  • Sora生成的示例视频截图:东京雨夜街道上女性行走的AI生成画面(Sora最经典的demo)
  • 静态画面 + GIF动画展示Sora的视频生成效果

各界大佬对Sora/AGI的看法

AGI指通用人工智能

人物 身份 观点
杨立昆 Meta首席AI科学家 不太看好Sora,认为抽象表示在AI中更重要
Google科学家 - 对Sora持审慎态度
周鸿祎 360总裁 表示支持,认为"Sora意味着AGI实现将从10年缩短到两三年"
马斯克 - 认为人类完蛋了(“gg humans”)

图片内容

  • 周鸿祎的微博截图,内容为关于Sora与AGI时间线的观点
  • Yann LeCun与Kevin Murphy的Twitter对话截图,讨论Sora与抽象表示在AI中的作用
  • Elon Musk的X帖子截图,配图为Sora生成的东京雨夜街道女性视频,文案为"gg humans"
  • Copilot对AGI的解释截图

三、Google Gemini

图片内容

  • Google AI进展时间轴中文信息图,涵盖2023年12月至2024年2月Gemini系列关键节点(Gemini Ultra/Pro/Nano发布等)
  • Gemini生成的示例图片:
    • 西部片风格的拓荒小镇场景(含木质建筑、骑马人物、溪流与山丘背景)
    • 女性时尚街拍(含黑色皮夹克、酒红色连衣裙、墨镜及东京霓虹夜景背景)

Google的种族偏见

图片内容:展示了Google Gemini在图片生成中的种族偏见问题相关截图,这是当时引发热议的争议事件


四、Tesla Grok

  • 本PPT制作时Grok还没公开测试,所以关于Grok的关注并不多

图片内容

  • Meme风格图片:长廊两侧超级英雄向中央xAI Grok标志鞠躬;中央有Grok Logo,下方黄底黑字"本周将开源Grok"
  • 两侧角色旁标注多个中国AI公司Logo(通义千问、智源悟道、360智脑、天工、讯飞星火、智元兔、OpenBMB、商量、WeLM、文心一言等)
  • 整体表达中国各大AI模型对Grok开源的关注与重视
  • PS:这张图当时还没开源

五、Nvidia投资:Perplexity AI

  • Perplexity AI获得Nvidia投资

图片内容:Perplexity AI的界面截图或相关投资新闻报道


六、Grop

图片内容:Grop相关介绍或演示截图(疑为Grok的笔误或早期写法)


七、国内AI

国内也有很多优秀的AI,而且不需要墙

中国四大AI

  • 百度文心一言
  • 科大讯飞星火
  • 阿里通义千问
  • 字节跳动豆包

图片内容:幻灯片中出现"中国AI领军人物李一舟"的相关图片

中国对AI发展贡献巨大

图片内容

  • 中国AI产业发展相关数据图表、发展里程碑或代表性产品截图
  • 展示中国在AI领域的重要贡献

百度文心一言

  • 严格意义上国内最早的生成式大模型
  • 印象中是去年3、4月推出的
  • 国内使用最广泛的AI了
  • 直接访问:https://yiyan.baidu.com/

图片内容:文心一言的对话界面截图及网上使用示例

文心一言的Bug与能力

  • 现在人家把Bug修好了,但换个问题估计又不行了
  • 可以看出数学与作图能力还是不错的

图片内容

  • 文心一言Bug修复前后的对比截图或模型输出样例
  • 文心一言数学计算与绘图能力的演示截图

文心一言4.0

  • 要氪金,我没用过,可以看看新闻

图片内容

  • 文心一言4.0相关新闻报道截图,涉及价格、会员或企业版介绍

阿里通义千问

图片内容:通义千问对话界面截图


科大讯飞星火

图片内容:讯飞星火界面截图,展示丰富的插件列表


字节跳动豆包

  • https://www.doubao.com
  • 可能是因为抖音的存在,图片制作很精美,而且有很多插件是为做视频而服务的
  • 视频创作+AI肯定是当下热门的潮流

图片内容

  • 豆包产品界面截图,展示其图像生成和视频相关功能
  • "豆包"图片制作精美!展示豆包生成的高质量图像作品

八、国内非主流AI

AI不仅是大厂在研究,很多国内新兴的企业也在研究,而且各有其优点

海螺问问

  • https://hailuoai.com/chat
  • 上海稀宇科技有限公司(MiniMax)开发
  • 公司估值20亿美元,融资达2.5亿美元
  • 目前只有APP,差评
  • 支持30秒的样本让用户克隆自己的声音

图片内容:海螺问问界面截图或语音克隆效果示例

Kimi Chat

  • https://kimi.moonshot.cn/
  • 月之暗面开发
  • 目前估值7亿美元,融资达20亿人民币
  • 可支持20万汉字上下文处理

图片内容:Kimi Chat对话界面截图,展示长文档处理能力

百川大模型

  • https://www.baichuan-ai.com
  • 公司估值18亿美元,融资达3亿美元
  • 在中文通用能力测评(CMMLU、GAOKAO、AGI-Eval)上超越GPT-4
  • 界面有点简陋(侧边栏好大)

图片内容

  • 百川大模型界面截图(界面简陋,侧边栏较大)
  • 评测成绩对比图或模型输出样例

智谱清言

  • https://chatglm.cn/
  • 公司估值140亿人民币,融资达25亿人民币
  • 清华背景,自研算法框架,对应开源模型在Github受好评
  • 反正光环很多

图片内容:智谱清言界面截图,可能包含清华相关标识或模型能力介绍


九、国内AI——图片生成AI

  • AI生成图功能基本上被整合了,但还有很多是专门给图片的
  • 大厂:百度的文心一格、阿里的通义万相、抖音的Dreamina、商汤科技的秒画
  • 画家出身:美图秀秀的WHEE、素材大户千库网的无限画

图片生成效果展示

总体而言还行:

AI名称 说明
文心一格 百度旗下图片生成AI
通义万相 阿里旗下图片生成AI
Dreamina 抖音旗下图片生成AI
秒画 商汤科技旗下图片生成AI

图片内容:四款AI图片生成工具的效果展示截图,展示各自生成的图片样例


十、国内AI——视频生成AI

国内有没有视频生成类呢?像Sora那种长视频的是没有的

目前有两类主要的视频生成类:

  1. 根据文案搜索视频
  2. 几秒的视频制作

这两种我都玩过,但是我做的视频惨不忍睹,就不放出来丢人现眼了,给大家看看网上别人的例子。

度加创作

图片内容:GIF动画展示度加创作的视频生成效果

即创

  • 抖音系列的,但是多了个数字人功能
  • https://aic.oceanengine.com/
  • 它的海外版CapCut AI Video以稳定的表现和良好的成像质量排名第一

图片内容

  • GIF动画展示即创的视频生成效果
  • CapCut AI Video的相关截图

8款国产AI视频生成对比

  • 这里还有8款国产AI生成类似Sora中女子走街头的画面,还是可圈可点的
  • 当然,它们只能生成这种几秒的视频
  • 国产AI想达到Sora的水平还是任重道远
  • 里面有一些开放公测的,可以去用一下

图片内容:GIF动画展示多款国产AI视频生成工具生成的"女子走街头"画面

具体视频AI工具

工具名 说明
Pixeling 国产视频生成AI
NeverEnds 国产视频生成AI
Vega AI 国产视频生成AI
艺映AI 国产视频生成AI

图片内容:GIF动画分别展示Pixeling、NeverEnds、Vega AI、艺映AI的视频生成效果

个人尝试

  • Eg:生成一个正在跳舞的女孩
  • 我自己尝试生成的一个视频(只能4秒)

十一、音乐生成类AI

  • 网易云天音(果然音乐软件就做音乐AI),可以一键输入灵感来创作
    • 可惜目前只对白名单用户使用
  • 国内目前开放公测的只有BGM猫

图片内容:BGM猫的界面截图


十二、AI时代已经在我们身边

  • 这份PPT主要介绍的是生成式大模型,但非生成式的AI已经在很久之前已经使用了。比如人脸识别
  • AI的落地将会很快实现
  • 虽然现在还没出现创新型的应用,但是已经有很多尝试性的创新了

图片内容

  • AI在日常生活各领域的应用场景展示
  • 阿里迎春AI相关截图(过年期间的AI互动体验)
  • 2022年深圳公司装监控回看程序员读写代码的新闻截图
  • 网络安全相关图片:“如果互联网是一把枪,那网络攻击就是原子弹”
  • 安全/监控/AI治理相关的新闻报道截图

以上内容整理自演讲PPT《一些好用的AI推荐》,涵盖PPT中所有文字内容及图片核心信息的文字化概括。