效率:本地部署模型意味着我们可以在单次 LLM 运行中解决任务(guidance 在程序执行时保持 LLM 状态) , 速度更快 , 成本更低 。当任何子步骤涉及调用其他 API 或函数(例如搜索、终端等)时尤其如此 , 这总是需要对 OpenAI API 进行新调用 。guidance 还通过不让模型生成输出结构标记来加速生成 , 这有时会产生很大的不同 。总的来说 , 该测试得出的结论是:MPT 还没有准备好在现实世界中使用 , 而 Vicuna 对于许多任务来说是 ChatGPT (3.5) 的可行替代品 。目前这些发现仅适用于该测试尝试的任务和输入(或 prompt 类型) , 该测试只是一个初步探索 , 而不是正式评估 。
更多结果参见 notebook:https://Github.com/microsoft/guidance/blob/main/notebooks/chatgpt_vs_open_source_on_harder_tasks.ipynb
【羊驼系列大模型和ChatGPT差多少?详细测评后,我沉默了】
推荐阅读
-
「印度」清一色机械化重装部队出现,印指挥官不再嘴硬,抱怨邻国隐藏实力
-
幽默笑话大王|我的话让司机懵了!,幽默笑话:开车被蹭了
-
『版权』独家版权即将到期,网易阿里抖音强敌环伺,腾讯音乐要往哪里走
-
躺倒鸭|腾讯开“卖”八位数QQ靓号充值超级会员即可使用
-
中国生物技术网|革命性突破!斯坦福团队找到关节软骨再生的方法!或将造福广大关节炎患者
-
-
现代出版社|称其为圣人,咋回事?,桓公曾拜管仲于马前
-
夏天的冰箱应该开多少档?冰箱夏季开到几档可以制冷_1
-
烹饪|凉拌土豆丝怎么做好吃?切丝焯水,开胃脆爽,上桌几分钟光盘
-
-
中国与西方神话的不同 从中西方神话故事看中国与西方的文化差异有哪些
-
-
燃气热水器打不着火是什么原因,燃气热水器不能打火怎么办
-
-
『OWNCAR奥卡』200元汽油开350公里油耗高?多少公里才正常?
-
十二星座魔羯座吧|化解尴尬的星座,心地善良,为他人着想,打圆场
-
华夏文物卖了468万,画一个地球又拍卖了3600万,马云随手写了2字
-
乳腺癌互助圈TB|揭开癌症转移之谜!原来与这种基因有关,它还影响着免疫治疗效果
-
-