Google Research 发布 Groundsource:用 Gemini 将新闻报道转为历史灾害数据
Google Research 发布 Groundsource,一个用 Gemini 把非结构化新闻报道转化为结构化历史数据的可扩展框架,首个开放数据集覆盖 150 多个国家、2000 年至今的 260 万条城市山洪事件记录。
Google Research 发布 Groundsource,一个用 Gemini 把非结构化新闻报道转化为结构化历史数据的可扩展框架,首个开放数据集覆盖 150 多个国家、2000 年至今的 260 万条城市山洪事件记录。
Mistral AI 发布 Mistral OCR 3(模型名 mistral-ocr-2512),在表单、扫描件、复杂表格和手写内容上对 Mistral OCR 2 的整体胜率达 74%,并称其精度超过企业级与 AI 原生 OCR 方案。
Mistral AI 演示了用 LoRA 微调 Pixtral-12B 在 Aerial Image Dataset(AID)上做卫星影像场景分类的完整流程。
Mistral AI 为 Le Chat 推出一批新功能,包括预览版 Deep Research 模式、基于 Voxtral 的语音模式、由推理模型 Magistral 驱动的多语言 Think 模式、Projects 文件夹,以及与 Black Forest Labs 合作的图像编辑。
推荐理由:原文逐项说明了新功能的定位与底层模型,读者可据此判断 Le Chat 在研究、语音、推理场景的能力边界。
Mistral AI 宣布发布 Mistral Small 3.1,基于 Mistral Small 3 升级,改进了文本性能与多模态理解,上下文窗口扩展至 128k tokens,推理速度达 150 tokens per second,以 Apache 2.0 许可开源。
推荐理由:原文列出了上下文、速度与运行门槛,读者可据此判断它是否适合端侧与低延迟场景。
Mistral AI 发布 OCR API Mistral OCR,可输入图像和 PDF,按顺序交错提取文本与图像,适合与 RAG 系统配合处理多模态文档。
推荐理由:原文给出基准对比与定价,读者可据此评估它在文档理解任务上替代现有 OCR 方案的空间。