首页 科技周边 人工智能 讯飞星火,AI燎原or熄灭?

讯飞星火,AI燎原or熄灭?

Jun 10, 2023 am 11:51 AM
ai 讯飞 燎原

本篇文章作者将从文本、问答、翻译、逻辑、代码编写和计算能力等几个方面,对比讯飞星火和ChatGPT两个应用的差别 ,希望这篇文章能对你有所帮助。

讯飞星火,AI燎原or熄灭?

讯飞星火6月9日迭代在即,一起来看看它是否能成为真的中文ChatGPT?本文将从多种指令角度,全面对比并评测下讯飞星火认知模型与ChatGPT的差异。

讯飞星火:继百度文心一言与众多国内AI平台发布后,讯飞星火发布的一款认知大模型,主要能力包括文本生成、语言理解、知识问答、逻辑推理、数学能力、代码能力、多模态能力。

笔者有幸成为讯飞星火体验的受邀人员,以普通工作者的身份,接下来分别从“文本生成、问答能力、语言翻译、逻辑推理、代码编写、数学计算能力”这几个方面进行评测对比。

(注:ChatGPT测试模型为3.5版本)

一、文本生成

讯飞星火在中文语言理解能力一定程度上是优于ChatGPT的。

可以看到下方对“七言绝句”的处理结果明显好于对方;但是对于日常工作的文本生成,ChatGPT文本更为自然。

相比较ChatGPT生硬的文字联想堆积,讯飞对于文学小说故事的生成理解更为深入。总体而言,中文的理解能力略胜一筹,但在普通文本生成方面,ChatGPT在大多数情况下更具优势。

关于生成诗词与邮件的对比:

讯飞星火,AI燎原or熄灭?

讯飞星火,AI燎原or熄灭?

二、问答能力

  • 工作上常规问题回答,讯飞星火更为通用化些,ChatGPT更为细致化,从匹配度上说,ChatGPT的参考价值会高些。
  • 都能理解普通的上下文记录。ChatGPT的记忆能力略强。
  • 中文常识问题,特别涉及到历史文化文学,星火对信息的检索与分析明显优于ChatGPT。

工作问题1:

讯飞星火,AI燎原or熄灭?

以下是讯飞星火:

讯飞星火,AI燎原or熄灭?

讯飞星火,AI燎原or熄灭?

工作问题2:

讯飞星火,AI燎原or熄灭?

讯飞星火,AI燎原or熄灭?

虽然表格和数据检索看起来处理得更快,但所获取的数据并非真实可信。使用这些数据回答问题可能会导致负增长。尽管ChatGPT无法获取精确数据,但它至少不会向用户提供虚假数据,这是星火急需改进的地方。

讯飞星火,AI燎原or熄灭?

常识问题:

讯飞星火,AI燎原or熄灭?

讯飞星火,AI燎原or熄灭?

讯飞星火,AI燎原or熄灭?

讯飞星火,AI燎原or熄灭?

三、语言翻译

两者都具有直译能力,但是涉及到中文的理解力,星火翻译的更有感染力一些.

例如下图示例中,ChatGPT使用的是“sprouting up”-发芽;而星火使用的是“emerging in droves”-“涌现”,明显字意表达更为贴切。

四、逻辑推理

  1. 逻辑陷阱。例如询问“爸妈结婚为啥不叫我”类似问题时,国内大部分语言模型都无法正确处理,ChatGPT的答案更为全面,星火直接选择不答。
  2. 基础的逻辑能力两者都具备。对于复杂的逻辑题目,两者回答的出错率都很高
  3. 逻辑分析的广度、深度总体ChatGPT优于星火。但ChatGPT这类语言模型只要脱离了常见的“常见区域”基本都会犯错,只是在错误中,ChatGPT的错误概率或者出错的离谱度小于星火。

逻辑问题1:

讯飞星火,AI燎原or熄灭?

讯飞星火,AI燎原or熄灭?

正确答案:

逻辑问题2:

讯飞星火,AI燎原or熄灭?

讯飞星火,AI燎原or熄灭?

可以看到此时ChatGPT就已经出现错误了,但仍然有一定的正确率。

再看星火,从第二个问题开始,“cpu”就已经被干烧了。

讯飞星火,AI燎原or熄灭?

讯飞星火,AI燎原or熄灭?

五、代码编写

两者都具备一定的代码编写能力,包括代码编写、代码注释、代码debug能力。

由于笔者不是专业开发人员,不能实际验证是否能真实编译但是从外部资料和输出结果看,讯飞星火对比刚发布时代码编写能力有一定提升,找错的准确度也更好于之前。

咨询过很多开发同学,ChatGPT整体实力上还是比星火优秀。

讯飞星火,AI燎原or熄灭?

讯飞星火,AI燎原or熄灭?

以上是星火纠错的一个实例。

六、数学计算能力

对于数学计算,所有的语言模型都存在短板,高难度的数学问题是十分严谨的,只要其中一个步骤出错答案就会出错。

计算机语言并不能像人类一样人性化地理解一些含义,例如它可能会把“10”解释为“1”和“0”两个数字。解决大部分数学问题需要进行复杂的推理逻辑,这使得计算机处理这些“定量推理”问题非常困难。

可以看下星火的数学计算实例:

讯飞星火,AI燎原or熄灭?

讯飞星火,AI燎原or熄灭?

可以看到,星火连题意都没理解清楚,但ChatGPT至少举例了一种情况。

七、总结

在全面体验讯飞星火后,同时将其与其他产品在工作中使用的情况进行对比,我发现在问题处理和多次prompt的情况下,ChatGPT提供的答案在参考价值和回答广度方面仍然更优。

自从百度文心一言推出后,讯飞星火是我使用过的最佳且最流畅的国内AI模型产品。可以说它完全配得上“星星之火”的称号。

然而,与OpenAI的技术相比,仍存在一定差距。同时,作为生产力工具,它的实用性稍弱一些。但在中文语言理解和特定常识问题方面,它具有一定的优势。

客观地说,讯飞已经取得了很大的进步,希望国内的互联网科技公司能够加紧追赶,不要让“西方成为潮流”,让“华流才是最吊的”。

本文由 @旺仔产品笔记 原创发布于人人都是产品经理,未经作者许可,禁止转载。

题图来自Unsplash,基于CC0协议。

以上是讯飞星火,AI燎原or熄灭?的详细内容。更多信息请关注PHP中文网其他相关文章!

本站声明
本文内容由网友自发贡献,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系admin@php.cn

热AI工具

Undresser.AI Undress

Undresser.AI Undress

人工智能驱动的应用程序,用于创建逼真的裸体照片

AI Clothes Remover

AI Clothes Remover

用于从照片中去除衣服的在线人工智能工具。

Undress AI Tool

Undress AI Tool

免费脱衣服图片

Clothoff.io

Clothoff.io

AI脱衣机

Video Face Swap

Video Face Swap

使用我们完全免费的人工智能换脸工具轻松在任何视频中换脸!

热门文章

<🎜>:泡泡胶模拟器无穷大 - 如何获取和使用皇家钥匙
3 周前 By 尊渡假赌尊渡假赌尊渡假赌
北端:融合系统,解释
3 周前 By 尊渡假赌尊渡假赌尊渡假赌
Mandragora:巫婆树的耳语 - 如何解锁抓钩
3 周前 By 尊渡假赌尊渡假赌尊渡假赌

热工具

记事本++7.3.1

记事本++7.3.1

好用且免费的代码编辑器

SublimeText3汉化版

SublimeText3汉化版

中文版,非常好用

禅工作室 13.0.1

禅工作室 13.0.1

功能强大的PHP集成开发环境

Dreamweaver CS6

Dreamweaver CS6

视觉化网页开发工具

SublimeText3 Mac版

SublimeText3 Mac版

神级代码编辑软件(SublimeText3)

热门话题

Java教程
1666
14
CakePHP 教程
1425
52
Laravel 教程
1328
25
PHP教程
1273
29
C# 教程
1253
24
C  中的chrono库如何使用? C 中的chrono库如何使用? Apr 28, 2025 pm 10:18 PM

使用C 中的chrono库可以让你更加精确地控制时间和时间间隔,让我们来探讨一下这个库的魅力所在吧。C 的chrono库是标准库的一部分,它提供了一种现代化的方式来处理时间和时间间隔。对于那些曾经饱受time.h和ctime折磨的程序员来说,chrono无疑是一个福音。它不仅提高了代码的可读性和可维护性,还提供了更高的精度和灵活性。让我们从基础开始,chrono库主要包括以下几个关键组件:std::chrono::system_clock:表示系统时钟,用于获取当前时间。std::chron

如何理解C  中的DMA操作? 如何理解C 中的DMA操作? Apr 28, 2025 pm 10:09 PM

DMA在C 中是指DirectMemoryAccess,直接内存访问技术,允许硬件设备直接与内存进行数据传输,不需要CPU干预。1)DMA操作高度依赖于硬件设备和驱动程序,实现方式因系统而异。2)直接访问内存可能带来安全风险,需确保代码的正确性和安全性。3)DMA可提高性能,但使用不当可能导致系统性能下降。通过实践和学习,可以掌握DMA的使用技巧,在高速数据传输和实时信号处理等场景中发挥其最大效能。

怎样在C  中处理高DPI显示? 怎样在C 中处理高DPI显示? Apr 28, 2025 pm 09:57 PM

在C 中处理高DPI显示可以通过以下步骤实现:1)理解DPI和缩放,使用操作系统API获取DPI信息并调整图形输出;2)处理跨平台兼容性,使用如SDL或Qt的跨平台图形库;3)进行性能优化,通过缓存、硬件加速和动态调整细节级别来提升性能;4)解决常见问题,如模糊文本和界面元素过小,通过正确应用DPI缩放来解决。

C  中的实时操作系统编程是什么? C 中的实时操作系统编程是什么? Apr 28, 2025 pm 10:15 PM

C 在实时操作系统(RTOS)编程中表现出色,提供了高效的执行效率和精确的时间管理。1)C 通过直接操作硬件资源和高效的内存管理满足RTOS的需求。2)利用面向对象特性,C 可以设计灵活的任务调度系统。3)C 支持高效的中断处理,但需避免动态内存分配和异常处理以保证实时性。4)模板编程和内联函数有助于性能优化。5)实际应用中,C 可用于实现高效的日志系统。

给MySQL表添加和删除字段的操作步骤 给MySQL表添加和删除字段的操作步骤 Apr 29, 2025 pm 04:15 PM

在MySQL中,添加字段使用ALTERTABLEtable_nameADDCOLUMNnew_columnVARCHAR(255)AFTERexisting_column,删除字段使用ALTERTABLEtable_nameDROPCOLUMNcolumn_to_drop。添加字段时,需指定位置以优化查询性能和数据结构;删除字段前需确认操作不可逆;使用在线DDL、备份数据、测试环境和低负载时间段修改表结构是性能优化和最佳实践。

怎样在C  中测量线程性能? 怎样在C 中测量线程性能? Apr 28, 2025 pm 10:21 PM

在C 中测量线程性能可以使用标准库中的计时工具、性能分析工具和自定义计时器。1.使用库测量执行时间。2.使用gprof进行性能分析,步骤包括编译时添加-pg选项、运行程序生成gmon.out文件、生成性能报告。3.使用Valgrind的Callgrind模块进行更详细的分析,步骤包括运行程序生成callgrind.out文件、使用kcachegrind查看结果。4.自定义计时器可灵活测量特定代码段的执行时间。这些方法帮助全面了解线程性能,并优化代码。

量化交易所排行榜2025 数字货币量化交易APP前十名推荐 量化交易所排行榜2025 数字货币量化交易APP前十名推荐 Apr 30, 2025 pm 07:24 PM

交易所内置量化工具包括:1. Binance(币安):提供Binance Futures量化模块,低手续费,支持AI辅助交易。2. OKX(欧易):支持多账户管理和智能订单路由,提供机构级风控。独立量化策略平台有:3. 3Commas:拖拽式策略生成器,适用于多平台对冲套利。4. Quadency:专业级算法策略库,支持自定义风险阈值。5. Pionex:内置16 预设策略,低交易手续费。垂直领域工具包括:6. Cryptohopper:云端量化平台,支持150 技术指标。7. Bitsgap:

deepseek官网是如何实现鼠标滚动事件穿透效果的? deepseek官网是如何实现鼠标滚动事件穿透效果的? Apr 30, 2025 pm 03:21 PM

如何实现鼠标滚动事件穿透效果?在我们浏览网页时,经常会遇到一些特别的交互设计。比如在deepseek官网上,�...

See all articles