跳到正文

产品更新

AI 产品与应用的功能上新、改版与商业化动态——谁家的产品变强了、变贵了、能用了。

157条精选相关主题模型发布行业动态AI 编码

最新精选

第 121–140 条 · 共 157 条
10月3日周四
10月1日周二
  1. OpenAI News62

    OpenAI API 推出 Prompt Caching 自动折扣

    OpenAI 在 API 中推出 Prompt Caching,对模型近期已处理过的输入自动提供折扣,降低重复输入的调用成本。

    推荐理由:说明了缓存如何自动降低近期已见输入的成本,读者可据此判断调用开销的变化。

8月12日周一
  1. Hugging Face Blog62

    Hugging Face Transformers 推出跨模型统一工具调用 API

    Hugging Face 在 Transformers 中推出跨模型统一的工具调用 API,同一份代码可在 Mistral、Cohere、NousResearch、Llama 等模型间移植,几乎无需模型特定改动,并配套辅助功能与完整文档示例。

    推荐理由:文章给出统一工具调用 API 的设计取舍与完整可运行示例,读者可直接迁移方法到自己的项目中。

8月6日周二
7月25日周四
6月12日周三
5月13日周一
4月24日周三
4月1日周一
3月20日周三
  1. Hugging Face Blog62

    Hugging Face 开源 Cosmopedia 合成数据集与 cosmo-1b 模型

    Hugging Face 发布 Cosmopedia,一个用 Mixtral-8x7B-Instruct-v0.1 生成、含超 3000 万文件和 25 billion tokens 的合成数据集,用于从零预训练大语言模型,目标是复现 Phi-1.5 的训练数据。

    推荐理由:原文拆解了从几千到千万级样本的提示词工程方法,可迁移给要做大规模预训练数据的团队。

2月13日周二
11月9日周四
11月6日周一
9月25日周一
8月28日周一
8月25日周五
  1. Hugging Face Blog78

    Hugging Face 集成 Code Llama 模型家族

    Hugging Face 宣布在自身生态中集成 Meta 的 Code Llama 模型家族,包含 7B、13B、34B 三种参数规模,以及 Python 专精版和指令微调版,采用与 Llama 2 相同的宽松社区许可并可商用。

    推荐理由:原文给出模型规格、上下文窗口扩展方法和多语言榜单成绩,便于评估其在代码任务上的定位。

8月23日周三
  1. Hugging Face Blog64

    Hugging Face 将 AutoGPTQ 集成进 Transformers,支持 8/4/3/2-bit 量化

    Hugging Face 宣布将 AutoGPTQ 库集成进 Transformers,用户可用 GPTQ 算法把模型量化到 8、4、3 甚至 2-bit 精度运行,4-bit 量化精度损失可忽略,小 batch 下推理速度接近 fp16 基线,同时支持 Nvidia 与 RoCm AMD GPU。

    推荐理由:原文给出了量化位宽、显存与延迟的实测对比,读者可据此判断能否在自己的 GPU 上跑起大模型。