计算机的相关内容 - 漫话开发者

2023-11-14 talkingdev

基于RWKV可在本地运行的AI小镇开源

AI 小镇是一个令人惊叹的实验，在这里，数百个代理在语言模型的提示状态下过着日常生活。 RWKV 模型是一种线性语言模型，需要比标准 Transformer 更少的资源。此存储库使用这个更便宜的模型在您的本地计算机上运行 A...

2023-11-10 talkingdev

Roboflow是一个计算机视觉工具包，通过可组合的代码片段使应用程序开发更加容易。现在，随着GPT-4 Vision进入OpenAI API，Roboflow团队已经制作了一些演示，展示如何与segment anything和DINO一起使用它。

2023-11-09 talkingdev

受 Actor 框架的启发，这个轻量级的 Python 库使得创建基于 LLM 动力的代理变得非常容易。Langroid 多智能体编程框架（Langroid multi-agent programming framework）最近发布了他们的 GitHub Repo，使得该项目的开...

2023-11-09 talkingdev

CogVLM-17B是一个开放式的视觉语言模型，具有100亿视觉参数和70亿语言参数。该模型在许多标准基准测试中表现出色，并在人类评估中表现良好。CogVLM-17B的性能优于以往的模型，将为计算机视觉和自然语言处理领域的发...

2023-11-09 talkingdev

Nvidia在IEEE/ACM计算机辅助设计国际会议上发表主题演讲，介绍了一款名为ChipNeMo的大型语言模型，旨在提高芯片设计师的生产力。尽管尚未完全证明，但ChipNeMo有助于为设计工具编写脚本，总结错误报告，并为设计师提...

2023-11-08 talkingdev

我们已经在不愿意投资只是包装GPT的公司方面看到了这一点，现在更加清晰了。随着能够查询上传的PDF的能力，一大批初创公司被抹去了。

2023-11-02 talkingdev

Hugging Face Space最近发布了两项重要技术：Segment Anything和MetaCLIP，这两项技术结合了最强大的语言模型和计算机视觉技术，能够基于文本输入进行开放式分词。开放式分词是计算机视觉领域中一个新颖且令人兴奋的...

2023-10-31 talkingdev

嵌入是一种机器可读的数字列表，用于表示有关数据的某些信息。它们越来越多地通过将数据通过神经网络并查看模型的激活来获得。本文在计算机视觉任务中使用CLIP推进了这一想法，并探讨了如何使用降维来推理学习到的嵌...