效率:本地部署模型意味着我们可以在单次 LLM 运行中解决任务(guidance 在程序执行时保持 LLM 状态) , 速度更快 , 成本更低 。当任何子步骤涉及调用其他 API 或函数(例如搜索、终端等)时尤其如此 , 这总是需要对 OpenAI API 进行新调用 。guidance 还通过不让模型生成输出结构标记来加速生成 , 这有时会产生很大的不同 。总的来说 , 该测试得出的结论是:MPT 还没有准备好在现实世界中使用 , 而 Vicuna 对于许多任务来说是 ChatGPT (3.5) 的可行替代品 。目前这些发现仅适用于该测试尝试的任务和输入(或 prompt 类型) , 该测试只是一个初步探索 , 而不是正式评估 。
更多结果参见 notebook:https://Github.com/microsoft/guidance/blob/main/notebooks/chatgpt_vs_open_source_on_harder_tasks.ipynb
【羊驼系列大模型和ChatGPT差多少?详细测评后,我沉默了】
推荐阅读
-
车家号|630马力新超跑,玛莎拉蒂MC20全球首发,新“海王”来了
-
如何正确引导孩子交朋友,如何正确引导孩子交朋友初中
-
鹿晗零点为关晓彤庆生|【围观吃瓜】鹿晗零点为关晓彤庆生,有点甜是怎么回事哦!
-
孔夫子搬家一一歇后语下一句 孔夫子搬家 一一歇后语
-
省心省力又省钱,解放J6P自动挡牵引车为啥这么受欢迎?
-
庞统那么厉害为什么会死?历史上的诸葛亮和庞统谁更厉害
-
历史神秘事|尽管武功谋略皆为一流,为何最终落得郁郁而终的下场呢,马超
-
地方|尤氏比王熙凤地位尊贵的多,这个地方她能进,凤姐没资格!
-
-
淘宝直播、问大家、猜你喜欢,95后最爱的淘宝三大功能
-
时间■再过4个月时间,新农合账户将会清零了,很多农民不懂怎么
-
重庆2号线最早几点开 重庆轨道交通2号线早晚高峰高开列车
-
国防时报军情|美国再出新招:将研制新型战机,实施未来直升机计划,为对抗中俄
-
全创优咖|3星座欣喜,终于获得心上人认可,牵手相伴到永生,在7月
-
小柒厨房菜■村厨猪手、肉丝南瓜花、菜心炒鱼片这几道家常菜的做法
-
|为什么懂人情世故的人更容易赚大钱,看懂的能少奋斗5年
-
-
土木女生国内设计院or造价还是出国读研,大二下迷茫求指点。?
-
肖战@被封杀?因不可抗拒的压力删掉肖战所有镜头,他是劣迹艺人?
-
腿比较细,但是上半身很胖,脖子粗,脸比较胖,怎么样做或者说合理的锻炼才能够让身体比例更加协调