跳到正文

#Agent

今日 11 条
今天10月3日周六
  1. The Decoder40

    DeepMind 研究人员提出“人工共生智能”作为奇点的替代方案

    DeepMind 研究人员提出“人工共生智能”概念,主张构建人与机器共存的生态系统以取代单一超级智能奇点。该观点基于对 DeepSeek-R1 和 QwQ-32B 等推理模型的研究,发现其通过强化学习自主产生类似群体辩论的多视角行为。作者认为,未来需通过协调智能体网络及设计类似法庭的新制度来治理人机协作,而非仅依赖单个模型。

  2. TechCrunch · AI48

    Airbnb CEO Brian Chesky:AI 智能体需要专属操作系统

    Airbnb 正在探索支持多人协作的“multiplayer”AI 界面,以解决单一用户限制问题。Brian Chesky 指出当前 AI 工具缺乏内核级操作系统,导致 Instinct 等智能体调用 Airbnb 功能体验不佳。他主张行业需构建完整的软件开发者工具包(SDK),使 AI 智能体能够像应用程序一样实现互操作性,而非仅作为单一主导入口。

  3. LessWrong · All Posts31

    AI for Epistemics and Coordination 领域现状综述

    本文综述了“AI for Epistemics and Coordination”这一新兴领域,旨在利用 AI 帮助人们形成更好的信念、做出明智决策并有效协调。该领域相对于其重要性而言发展不足,而早期产品和标准可能塑造用户对 AI 的期望及 Agent 协调方式,因此不能仅依赖现有商业和机构激励来推动这些工具的构建,需尽早建立评估规范与基础设施。

  4. The Verge · AI64

    实测 OpenAI Dots 智能体:企业级 Agent 也能帮忙点外卖

    OpenAI 新发布的智能体平台 Dots 以拟人化角色提供云端虚拟环境操作能力,作者基于不同任务实测了该平台。虽然 Dots 在处理日常个人事务时常遇到网站安全验证拦截或执行偏差,但在连接本地电脑后能高效完成网站更新和视频剪辑等任务。作者认为 Dots 更像是面向企业或专业工作流的智能体工具,其定位与更侧重个人消费的同类竞品有明显差异。

10月2日周五
  1. AWS Machine Learning Blog52

    Adjudicated Query 模式:用 Amazon Quick 完成大规模合规审查

    AWS 发布 Adjudicated Query 设计模式及参考架构,用 Amazon Quick 对话层连接确定性规则引擎,可完成数万份租约的合规审查。该模式通过 6 个 MCP 工具限定 AI 操作边界,生成完整性回执确保所有记录被评估,并支持证据链追踪,适用于制裁筛查、保险理赔等高风险合规领域。

  2. The Verge · AI29

    AI幻觉加剧顾客对服务人员的质疑与冲突

    生成式AI的幻觉正导致顾客固执地相信错误信息,甚至无视服务人员的专业警告。餐厅员工面临顾客坚持“ChatGPT说没有海鲜”的荒谬场景,部分顾客甚至因AI胡编的酒款而绕过侍酒师。这种现象还延伸至电影院、咖啡馆及户外公园,使客服人员反复应对基于AI胡说的无理要求。

10月1日周四
9月30日周三
9月29日周二
  1. 36氪61

    腾讯 Marvis 升级 AI 管家功能:管理电脑硬件与本地文件

    腾讯将应用宝团队开发的个人 Agent Marvis 升级为AI管家,日活跃用户较5月上线时增长近四倍。新版功能聚焦电脑系统管理,可检查电池健康、调整开机启动项,并将本地知识库算力门槛降至4核8GB。Marvis采用端侧模型建立授权资料索引,按需调用云端模型,计划10月推出支持NAS存储的定制版本。

9月16日周三
9月14日周一
9月11日周五
9月7日周一
8月28日周五
8月22日周六
  1. Rohan's Bytes44

    研究发现 ChatGPT 发布以来 1/3 网页由 AI 撰写

    皮尤研究中心(Pew Research)研究显示,ChatGPT 发布以来约有 1/3 的网页显示由 AI 撰写或编辑的迹象。截至 2026 年,.com 网页中 AI 关联内容占比达 9.4%,远高于 .edu 的 1% 和 .gov 的 0.8%。这种分布不均源于商业出版商利用 AI 提升产能的经济动机,而公共机构受限于流程与激励不足。

8月13日周四
8月10日周一
8月4日周二
  1. Towards AI39

    2026年如何学习AI工程:围绕核心决策构建工程判断力

    学习AI工程应围绕五个核心决策展开:是否使用LLM、系统架构选型(提示词/RAG/微调/智能体)、数据接入与人工介入点、成功标准及评估、以及失败处理机制。作者建议通过阅读基础资料、构建小型系统并加入评估数据集与追踪功能来积累经验,利用评估与反馈转化工程判断力。相关学习路径已整理为免费的公开GitHub路线图,并附带可定制课程大纲的提示词。

7月29日周三
  1. Towards AI28

    创作者分享 AI Agent 团队将 YouTube 视频制作工作量降低 90% 的自动化经验

    创作者使用 AI Agent 团队将单条 YouTube 视频的制作周期从两至三天压缩至五小时,工作量降低 90%。该流程将研究设计为可探索方向的 Agent,写作则设为受约束的工作流以保持一致性。创作者保留了选题方向、观点塑造与最终事实核查环节在人工控制范围内,其余执行步骤由自动化流水线完成。

7月17日周五
  1. Google DeepMind84

    Google 发布轻量化网络安全模型 Gemini 3.5 Flash Cyber

    Google 发布基于 Gemini 3.5 Flash 微调的网络安全模型 Gemini 3.5 Flash Cyber,用于高效发现、验证和修复代码漏洞。该模型通过限制政府及可信合作伙伴的试点计划访问,在 CyberGym 和 Chrome 生产环境等测试中展现了优于主线路基模型和更大模型的高效性能,已用于保护 Google 内部代码库。

    推荐理由:官方发布了针对网络安全微调的轻量化模型,提供了在漏洞扫描任务中降低成本并提升覆盖率的实操架构。

6月26日周五
  1. Towards AI33

    AI Engineer 演讲:基于纯文件引用的 AI 研究操作系统如何解决 Agent 记忆复用难题

    作者在 AI Engineer 世界博览会的主题演讲中展示了一款基于纯文件和引用的 AI 研究操作系统,旨在解决 Agent 难以复用长期记忆的问题。该系统通过三层结构(原始源、索引、维基)将 Obsidian 或 GitHub 等来源转化为可查询和检查的记忆,无需向量数据库或知识图谱。

6月19日周五
6月17日周三
6月11日周四
4月21日周二
  1. Hugging Face Blog52

    AI 与网络安全未来:为什么开放性很重要

    Hugging Face 讨论前沿模型 Mythos 及其嵌入系统在发现、修复软件漏洞中的表现,指出网络安全是涉及漏洞检测、验证、协调和补丁传播的速度竞赛。作者认为开放代码和工具能为防御方提供结构化优势,并建议采用基于开放组件的半自主 AI Agent,在组织自己的控制范围内运行以辅助安全防御。