青蛙小白
#Agent #Aigc

AI Agents for Beginners笔记: 4.工具使用设计模式

工具之所以有趣,是因为它们使AI智能体能够拥有更广泛的能力范围。通过添加工具,智能体不再局限于一组有限的动作,而是能够执行多种多样的动作。在本章中,我们将探讨工具使用设计模式,该模式描述了AI智能体如何使用特定工具来实现其目标。 什么是工具使用设计模式? 工具使用设计模式聚焦于赋予大语言模型(LLMs)与外部工具交互的能力,以实现特定目标。工具是可以由智能体执行的代码,用于执行动作。一个工具可以是简单的函数,例如计算器,或者是对第三方服务的API调用,例如查询股票价格或天气预报。在AI智能体的背景下,工具被设计为由智能体根据模型生成的函数调用来执行。

#Agent #Aigc

AI Agents for Beginners笔记: 3.AI智能体设计原则

关于构建AI智能系统,有许多不同的思考方式。由于在生成式AI设计中,模糊性是一种特性而非缺陷,因此工程师有时会难以确定从哪里开始。 《AI Agents for Beginners》制定了一套以人为中心的用户体验设计原则,旨在帮助开发者构建以客户为中心的智能体系统,以满足他们的业务需求。这些设计原则并不是一种规定性的架构,而是为定义和构建智能体体验的团队提供的起点。

#Agent #Aigc

AutoGen笔记:01.从零开始构建第一个AI智能体

AutoGen是什么? AutoGen是一个用于构建AI智能体和应用程序的框架。 AutoGen框架由以下几个部分组成: 基于AutoGen 0.4.x版本 Core AgentChat Extensions Studio Magentic-One CLI Core AutoGen Core 是一个用于构建可扩展的多智能体AI系统的事件驱动编程框架。示例场景: 用于业务流程的确定性和动态的智能体工作流程。 多智能体协作研究。 用于多语言应用程序的分布式智能体。 如果你正在构建工作流程或分布式智能体系统,请从这里开始。

#Agent #Aigc

AI Agents for Beginners笔记: 1.AI Agent及使用场景简介

本文是微软AI Agents for Beginners课程的学习笔记。随着AI技术的发展,AI Agent正在成为构建智能应用的重要范式。本文将介绍AI Agent的基础概念、类型和应用场景。 AI Agent的定义和类型 AI Agent的定义 AI Agent是通过为LLMs(大语言模型)提供tools(工具)和knowledge(知识)的访问权限,从而扩展其能力以执行操作(action)的系统(system)。

#Cursor

小白的Cursor入门指南

从VS Code, (Code-Server)转到Cursor,不知不觉已经三个月了。这三个月里,Cursor逐渐成为了我的主力开发工具,它强大的 AI Promgraming功能极大地提升了日常开发和工作的效率。本文是基于Cursor官方文档,整理的入门指南。 Cursor是VS Code的一个fork,在VS Code文本编辑的基础上,开发如何以最好的方式使用AI编程的功能。 Cursor会定期基于VS Code的最新版本作为基础更新(rebase)。

#AI Agent

构建高效的Agent[译文&笔记]

原文: Building effective agents, 作者: Anthropic, Dec 20, 2024 https://www.anthropic.com/research/building-effective-agents 过去一年,我们与数十个团队合作,构建了跨行业的大型语言模型(LLM)智能体。我们发现,最成功的实现并没有使用复杂的框架或专门的库,而是使用简单、可组合的模式构建的。 在这篇文章中,我们将分享我们与客户合作以及自行构建智能体的经验,并为开发人员提供构建有效智能体的实用建议。

#Aigc

开始使用Gemini API

Google AI产品Gemini的API有很多免费额度,而且兼容OpenAI API,我也开始使用了它的API了。 免费额度 从免费额度上看Google还算慷慨, gemini-1.5-flash每天1500次请求也足够个人学习使用。 https://ai.google.dev/pricing 模型名称 简介 免费层级限制 gemini-1.5-flash 速度最快的多模态模型,在各种重复性任务中表现出色,有100万的上下文窗口 15RPM, 1 million TPM, 1500RPD gemini-1.5-flash-8b 最小的模型,适用于对智能要求不高的场景,100万上下文窗口 15RPM, 1 million TPM, 1500RPD gemini-1.5-pro 下一代模型,200万上下文窗口,已经生产可用 2RPM, 32000TPM, 50RPD gemini-1.0-pro 第一代模型仅提供文本和图像推理,生产可用 15RPM, 32000TPM, 1500RPD text-embedding-004 文本嵌入模型 1500RPM RPM - requests per minute TPM - tokens per minute RPD requests per day 开通Gemini API Gemini API的开通方式,是在Googlle AI Studio中申请API Key。