跳到正文

#推理

今日 7 条
今天10月3日周六
  1. LessWrong · All Posts55

    什么是递归自我改进?禁止它意味着什么?

    文章探讨了递归自我改进(RSI)的概念,即AI模型自动构建更强大后继者的反馈循环。文中引用了Anthropic、OpenAI等机构的近期表态,指出虽然它们都强调需极度谨慎对待RSI,但并未完全禁止,而是强调安全性。文章还提及了Ezra Klein等人呼吁禁止RSI的观点,认为这关乎人类对AI前沿的控制权。

  2. LessWrong · All Posts31

    AI for Epistemics and Coordination 领域现状综述

    本文综述了“AI for Epistemics and Coordination”这一新兴领域,旨在利用 AI 帮助人们形成更好的信念、做出明智决策并有效协调。该领域相对于其重要性而言发展不足,而早期产品和标准可能塑造用户对 AI 的期望及 Agent 协调方式,因此不能仅依赖现有商业和机构激励来推动这些工具的构建,需尽早建立评估规范与基础设施。

  3. LessWrong · All Posts30

    库斯科的 Petrov Day:烛光下的 AI 反思

    作者在秘鲁库斯科为读书会“De Profundis”举办烛光演讲,纪念 1983 年成功阻止核误判的 Stanislav Petrov。作者引用 Petrov 名言“计算机没有大脑”,指出随着 AI 发展,人类日益丧失质疑机器的能力与最后裁决权。文章反思了当前环境下 AI 对人类判断力的挑战,呼吁给予 AI 更多时间来审慎发展。

  4. Hacker News77

    ds4 发布:支持本地运行 DeepSeek V4 等前沿模型

    ds4 是由 antirez 发布的本地推理引擎,支持在 M5 Max 和 DGX Spark 等高显存设备上运行 DeepSeek V4、GLM 5.x 及 Qwen3.8 等模型。该引擎采用 2-bit 非对称量化压缩路由专家,并提供 CLI、本地 API 及原生 Agent 接口,支持将 KV 缓存持久化至 SSD 以加速恢复会话。

    推荐理由:提供了非通用引擎的窄化路径,展示了在特定高配硬件上运行前沿开源模型的量化细节与接口规范。

10月2日周五
9月14日周一
8月25日周二
7月16日周二
  1. Mistral AI44

    Mistral 开源数学推理模型 Mathstral

    Mistral AI 在 Project Numina 项目中发布数学推理模型 Mathstral,基于 Mistral 7B 构建。该模型在 MATH 基准测试中得分为 56.6%,MMLU 得分为 63.47%。Mathstral 已在 HuggingFace 开放权重,支持通过 mistral-inference 使用。

3月18日周一
3月2日周三
  1. Hugging Face Blog23

    BERT 101:解读 NLP 领域尖端模型

    BERT 是由 Google AI Language 于 2018 年开发的自然语言处理模型,利用 Transformer 架构实现了双向文本理解。该模型通过 3.3 亿词的数据集训练,解决了情感分析等 11 类常见 NLP 任务。其衍生版本 DistilBERT 速度提升 60%,同时保持了 95% 以上的性能。