跳到正文

内容形态

产品更新 最新动态

AI 产品与应用的功能上新、改版与商业化动态——谁家的产品变强了、变贵了、能用了。

98 条精选近 30 天 27 条共收录 328 条

更新

精选归档 · 第 4 页

8月7日周三第 61–80 条
  1. Mistral AI65

    Mistral AI 发布模型定制、Agents 与 1.0 版 SDK

    Mistral AI 宣布在 La Plateforme 上开放旗下旗舰及专用模型的定制能力,支持通过 base prompt、few-shot prompting 或 fine-tuning 微调,并可接入自带数据集。

    推荐理由:Mistral 在自家平台同时开放模型定制、智能体与稳定版 SDK,为开发者把前沿模型接入应用提供更完整的路径。

5月13日周一
  1. Hugging Face Blog78

    Transformers Agents 2.0 发布,Llama-3 在 GAIA 榜单超越 GPT-4 智能体

    Hugging Face 发布了 Transformers Agents 2.0,引入支持迭代观察的新智能体结构,并强调代码的模块化与工具使用的透明性。基于该框架、以 Llama-3-70B-Instruct 为底层的智能体在 GAIA 基准测试中表现优于多个 GPT-4 基智能体,取得榜单第四名,目前处于开源类最佳位置。

    推荐理由:官方开源框架 smolagents 引入了能迭代观察的多智能体结构,Llama-3 在 GAIA 榜单上表现优于 GPT-4 智能体。

5月3日周五
  1. Hugging Face Blog60

    Hugging Face 引入 Artificial Analysis LLM 性能榜单

    Hugging Face 正式引入 Artificial Analysis 开发的 LLM 性能榜单,该榜单覆盖 100 多个 LLM API 端点,统一提供模型质量、价格、吞吐量与延迟指标。

    推荐理由:原文将价格、速度与质量指标整合在单一榜单中,AI 工程师可据此在应用设计阶段对推理成本与延迟做出更具体的权衡。

4月2日周二
  1. Hugging Face Blog65

    Hugging Face 上线 Cloudflare Workers AI 无服务器 GPU 推理功能

    Hugging Face 推出与 Cloudflare Workers AI 的新集成,开发者可通过按请求付费的方式,在全球边缘 GPU 上运行热门开源模型。该功能支持 Meta Llama 2 7B、Mistral 7B 等模型,用户可在模型页面直接选择部署并通过 REST API 或 Cloudflare AI SDK 发起请求。

    推荐理由:将热门开源模型集成至 Cloudflare 无服务器推理平台,开发者可按请求付费运行。

2月8日周四
12月11日周一
  1. Mistral AI62

    Mistral AI 开放 la plateforme 平台服务 beta 权限

    Mistral AI 开放了首个平台服务的 beta 权限,提供三个文本生成端点和一个嵌入端点。Mistral-tiny 端点基于 Mistral 7B Instruct v0.2,Mistral-small 基于 Mixtral 8x7B,Mistral-medium 基于原型模型,三者分别在 MT-Bench 上取得 7.6、8.3 和 8.6 分。

    推荐理由:Mistral AI 开放了首个平台服务 beta 权限,并给出了三个推理端点与嵌入端点的基准表现,方便开发者对比选择。

12月5日周二
  1. Hugging Face Blog76

    Optimum-NVIDIA 库发布:通过一行代码和 FP8 量化实现 LLM 推理加速

    Hugging Face 发布 Optimum-NVIDIA 推理库,支持在 NVIDIA 平台上通过修改一行代码启用 FP8 量化,实现最高 28 倍推理加速和 1200 tokens/s 的吞吐量。

    推荐理由:提供了从 Transformers 迁移至 Optimum-NVIDIA 的代码对比,展示了 FP8 量化在降低首字延迟和提升吞吐量方面的具体收益。

  2. Hugging Face Blog65

    AMD 与 Hugging Face 合作实现 AMD GPU 开箱即用的大语言模型加速

    Hugging Face 宣布现已支持在 AMD Instinct GPU 上开箱即用地运行所有 Transformers 模型和任务,无需修改任何代码即可替换 NVIDIA GPU 的部署流程。

    推荐理由:Hugging Face 和 AMD 给出了在 AMD Instinct GPU 上直接运行 Transformers 模型和部署 TGI 的入口,读者可以据此把现有 NVIDIA 工作流迁移过去。

11月9日周四
  1. Hugging Face Blog83

    Hugging Face 发布 SDXL Latent Consistency LoRAs,实现 4 步生成

    Hugging Face 与 LCM 团队合作发布 SDXL Latent Consistency LoRAs,使 SDXL 生成步骤从 25 至 50 步降至 4 至 8 步。M1 Max 上生成 1024x1024 图像耗时约 6.5 秒,4090 上不到 1 秒,且可与其他 SDXL LoRA 组合使用。

    推荐理由:原文展示了 LCM LoRA 将 SDXL 推理降至 4 步的方法,并提供多组硬件性能基准,便于评估低成本生成效果。

11月6日周一
10月19日周四
10月3日周二
  1. Hugging Face Blog87

    Hugging Face Tokenizer 新增 chat_template 属性以解决聊天模型格式不匹配问题

    Hugging Face 在 tokenizer 中新增 chat_template 属性,用于存储模型训练时使用的 Jinja 聊天格式模板。由于不同聊天模型采用各异的消息格式化方式,使用错误格式会导致严重的性能下降且难以调试,该功能将格式逻辑从代码库移至模型仓库,允许用户通过 tokenizer.apply_chat_template() 自动匹配正确格式。

    推荐理由:文章解释了 Chat template 如何解决格式错配导致的性能衰减问题,并给出了在 Hugging Face 生态中配置该属性以统一推理流程的具体方法。

9月29日周五
9月25日周一
9月22日周五
  1. Hugging Face Blog64

    Hugging Face 上线 Inference for PROs:PRO 用户可加速调用 Llama 3、Mixtral 等模型 API

    Hugging Face 推出面向 PRO 订阅用户的 Inference API 服务,通过基于 text-generation-inference 的专属端点,为精选模型提供更高速率限制和更快的推理体验。

    推荐理由:Hugging Face 将 Llama 3 和 Mixtral 等热门模型的 API 接入纳入付费订阅,并兼容 OpenAI 调用规范,便于用户直接替换现有代码。

8月31日周四
8月25日周五
  1. Hugging Face Blog86

    Hugging Face 发布 Code Llama 模型及生态系统集成

    Hugging Face 发布 Code Llama 家族模型,提供 7B、13B 和 34B 参数版本及其 Python 特化与指令微调变体。基于 Llama 2 并经过 500B tokens 代码数据训练,支持 16k 上下文扩展至 100k。

    推荐理由:展示了 Code Llama 在 Hugging Face 生态中的完整部署与微调路径,为工程师提供了可复用的生产级工具链。

8月23日周三
  1. Hugging Face Blog60

    Hugging Face 在 Transformers 中整合 AutoGPTQ 实现大模型轻量化

    Hugging Face 官方宣布将 AutoGPTQ 库整合进 Transformers,支持使用 GPTQ 算法将模型量化为 8、4、3 或 2 位精度。4 位量化下准确率损失微乎其微,且小批量推理速度与 fp16 基准相当。

    推荐理由:Hugging Face 官方将 AutoGPTQ 量化库整合进 Transformers,提供 4-bit 等低精度支持并展示在单卡 A100 上运行大模型的基准表现。

7月20日周四
5月18日周四
  1. OpenAI News74

    OpenAI 推出 ChatGPT iOS 应用

    OpenAI 发布 ChatGPT 的 iOS 应用,支持对话同步、语音输入,并集成了最新的模型改进。

    推荐理由:原文说明 ChatGPT iOS 应用同步对话和语音输入,方便读者了解移动端功能更新。