大规模模型的发展受到限制,需要创建可解释的人工智能理论
GPT-4的局限在于仅能与数字世界互动,而我们最终需要与物理世界互动。为此,机器人的出现尤为重要,它代表着具身智能的实现。张钹指出,并非必须开发人形机器人,也不需要过于复杂的硬件。他主张以一定的硬件为基础进行强化学习研究。这样的方法可以在不改变原有意义的情况下进行微调。
全世界对大模型的强大能力和潜力感到惊讶,但无法解释其原因,只能将其归结为“涌现”现象。为了人工智能产业的健康发展,必须综合科学研究、技术创新和产业发展。要发展第三代人工智能,必须建立可解释和鲁棒的理论和方法,否则AI技术将永远难以令人信服。
大语言模型存在天花板。
虽然通向通用人工智能的道路依然艰难,但大语言模型为AI产业开辟了一条宽广的道路。在智谱AI 2024年度技术开放日上,张钹院士表示,大模型为发展通用硬件和软件提供了机会。
传统AI范式利用特定的算法和规则完成特定任务,生成式AI范式是基于一种称为基础模型的通用模型,通过广泛文本数据的训练,在开领域(open domain,开域)内可以生成类似于人类水平的高质量文本、图像和其他内容,通过微调等方式可适配于广泛的下游任务。生成式AI向通用AI迈出一步,第二步是AI智能体,第三步则是具身智能。张钹表示,GPT-4只能和数字世界打交道,我们最终必须跟物理世界打交道,这就需要机器人,也就是具身智能。具身智能的提出有助于构造完整的智能体,让智能体既有感知,又有思考。“不一定要做人形机器人,因为很多时候只要用手或脚就可以了,不需要把硬件搞得非常复杂。”他主张以一定的硬件为基础进行强化学习研究。
生成式AI大模型具备三大能力和一大缺点。首先是强大的生成能力,它能够根据上下文和过去的对话生成多样性的连贯文本,让人们感到惊讶。其次是强大的迁移能力,即通过代理任务的训练和细调适配,能够应用到感兴趣的下游任务中。第三是强大的交互能力,包括人机交互、多智能体之间的交互以及与环境的交互,使得AI能够在各个领域展现出与人类相媲美的智能水平。然而,这些大模型也存在一个缺点,即幻觉。有时候,它们会生成看似合理的编造或无意义的答案。
人工智能有助于推动经济增长,建筑、维护、安装等行业难以被自动化和智能化,但行政管理等白领工作或被AI替代。AI可提高大多数人类工作的质量和效率,但被AI完全替代的工作仍是少数。之所以AI还不能替代大多数工作,是因为大模型还存在难以逾越的天花板。张钹表示,大模型的所有工作都是外部提示而非主动,并且在外部提示的情况下利用概率预测完成任务,而人类的工作依靠内部意图驱动。大语言模型生成语言与人类语言生成只是行为上的相似性,而内在机制根本不同,大语言模型存在不自知、质量不可控、不可信、不鲁棒等天花板,给出不同的提示词,大模型会输出不同的回答。大模型也会产生幻觉,“不管模型多么大,幻觉这个缺点一直存在。”
他提出,要发展第三代人工智能,必须建立可解释和鲁棒的人工智能理论和方法,发展安全、可控、可信、可靠、可扩展的AI技术,推动AI的创新应用和产业化。如果不能建立可解释和鲁棒的人工智能理论,AI技术是不可靠的,AI技术永远难以令人相信。“到现在为止,这个理论还没有建立起来,这也是人工智能之所以发展缓慢和曲折的原因。理论建立不起来,是因为受到三个特定限制,过去只能在特定领域利用特定模型解决特定任务,这怎么可能建立通用理论?大模型的出现为建立这个理论提供了可能性。”
张钹表示,大模型为我们提供了发展通用硬件和软件的机会。人工智能正进入稳步发展的阶段,对各行各业有巨大影响,必须抓住机遇发展人工智能产业。但仍有大量不确定性,因为AI不可预测、不可控。全世界对大模型强大的生成能力、迁移能力、交互能力感到惊讶,却无法解释,只能归结为“涌现”。所以为了人工智能产业的健康发展,必须将科学研究、技术创新、产业发展结合起来。
以上是大规模模型的发展受到限制,需要创建可解释的人工智能理论的详细内容。更多信息请关注PHP中文网其他相关文章!

热AI工具

Undresser.AI Undress
人工智能驱动的应用程序,用于创建逼真的裸体照片

AI Clothes Remover
用于从照片中去除衣服的在线人工智能工具。

Undress AI Tool
免费脱衣服图片

Clothoff.io
AI脱衣机

AI Hentai Generator
免费生成ai无尽的。

热门文章

热工具

记事本++7.3.1
好用且免费的代码编辑器

SublimeText3汉化版
中文版,非常好用

禅工作室 13.0.1
功能强大的PHP集成开发环境

Dreamweaver CS6
视觉化网页开发工具

SublimeText3 Mac版
神级代码编辑软件(SublimeText3)

热门话题

5月30日,腾讯宣布旗下混元大模型全面升级,基于混元大模型的App“腾讯元宝”正式上线,苹果及安卓应用商店均可下载。相比此前测试阶段的混元小程序版本,面向工作效率场景,腾讯元宝提供了AI搜索、AI总结、AI写作等核心能力;面向日常生活场景,元宝的玩法也更加丰富,提供了多个特色AI应用,并新增了创建个人智能体等玩法。“腾讯做大模型不争一时之先。”腾讯云副总裁、腾讯混元大模型负责人刘煜宏表示:“过去的一年,我们持续推进腾讯混元大模型的能力爬坡,在丰富、海量的业务场景中打磨技术,同时洞察用户的真实需求

火山引擎总裁谭待企业要做好大模型落地,面临模型效果、推理成本、落地难度的三大关键挑战:既要有好的基础大模型做支撑,解决复杂难题,也要有低成本的推理服务让大模型被广泛应用,还要更多工具、平台和应用帮助企业做好场景落地。——谭待火山引擎总裁01.豆包大模型首次亮相大使用量打磨好模型模型效果是AI落地最关键的挑战。谭待指出,只有大的使用量,才能打磨出好模型。目前,豆包大模型日均处理1,200亿tokens文本、生成3,000万张图片。为助力企业做好大模型场景落地,字节跳动自主研发的豆包大模型将通过火山

“高度复杂、碎片化程度高、跨领域”一直是交通行业数智化升级路上的首要痛点。近日,由中科视语、西安市雁塔区政府、西安未来人工智能计算中心联合打造的参数规模千亿级的“秦岭·秦川交通大模型”,面向智慧交通领域,为西安及其周边地区打造智慧交通创新支点。 “秦岭·秦川交通大模型”结合西安当地海量开放场景下的交通生态数据、中科视语自研的原创先进算法以及西安未来人工智能计算中心升腾AI的强大算力,为路网监测、应急指挥、养护管理、公众出行等智慧交通全场景带来数智化变革。交通管理在不同城市有不同的特点,不同道路的交

一、TensorRT-LLM的产品定位TensorRT-LLM是NVIDIA为大型语言模型(LLM)开发的可扩展推理方案。它基于TensorRT深度学习编译框架构建、编译和执行计算图,并借鉴了FastTransformer中高效的Kernels实现。此外,它还利用NCCL实现设备间的通信。开发者可以根据技术发展和需求差异,定制算子以满足特定需求,例如基于cutlass开发定制的GEMM。TensorRT-LLM是NVIDIA官方推理方案,致力于提供高性能并不断完善其实用性。TensorRT-LL

一、背景简介首先来介绍一下云问科技的发展历程。云问科技公...2023年,正是大模型盛行的时期,很多企业认为已经大模型之后图谱的重要性大大降低了,之前研究的预置的信息化系统也都不重要了。不过随着RAG的推广、数据治理的盛行,我们发现更高效的数据治理和高质量的数据是提升私有化大模型效果的重要前提,因此越来越多的企业开始重视知识建设的相关内容。这也推动了知识的构建和加工开始向更高水平发展,其中有很多技巧和方法可以挖掘。可见一个新技术的出现,并不是将所有的旧技术打败,也有可能将新技术和旧技术相互融合后

4月4日消息,日前,国家网信办公布已备案大模型清单,中国移动“九天自然语言交互大模型”名列其中,标志着中国移动九天AI大模型可正式对外提供生成式人工智能服务。中国移动表示,这是同时通过国家“生成式人工智能服务备案”和“境内深度合成服务算法备案”双备案的首个央企研发的大模型。据介绍,九天自然语言交互大模型具有行业能力增强、安全可信、支持全栈国产化等特点,已形成90亿、139亿、570亿、千亿等多种参数量版本,可灵活部署于云、边、端不同场

如果试题太简单,学霸和学渣都能考90分,拉不开差距……随着Claude3、Llama3甚至之后GPT-5等更强模型发布,业界急需一款更难、更有区分度的基准测试。大模型竞技场背后组织LMSYS推出下一代基准测试Arena-Hard,引起广泛关注。Llama3的两个指令微调版本实力到底如何,也有了最新参考。与之前大家分数都相近的MTBench相比,Arena-Hard区分度从22.6%提升到87.4%,孰强孰弱一目了然。Arena-Hard利用竞技场实时人类数据构建,与人类偏好一致率也高达89.1%

6月13日消息,据字节旗下“火山引擎”公众号介绍,小米旗下人工智能助手“小爱同学”与火山引擎达成合作,双方基于豆包大模型实现更智能的AI交互体验。据悉,字节跳动打造的豆包大模型,每日能够高效处理数量多达1200亿个的文本tokens、生成3000万张内容。小米借助豆包大模型提升自身模型的学习与推理能力,打造出全新的“小爱同学”,不仅更加精准地把握用户需求,还以更快的响应速度和更全面的内容服务。例如,当用户询问复杂的科学概念时,&ldq
