-
Anthropic 发布 Claude Haiku 5.5:自称最便宜最快的小模型,运行成本比 Haiku 4.5 低 75%
2026 年 10 月 7 日,Anthropic 在官方发布页《Introducing Claude Haiku 5.5》中推出新一代小模型,模型 ID 为 claude-haiku-5-5,并称它是公司迄今最便宜、最快、能力最强的小模型。本文依据该官方页面整理,所有性能、价格与评测数字均为厂商自述,不是独立测评。官方页面中「准确率 vs. 成本」图表只有图例与坐标轴能以文本方式采集,各数据点的具体数值未取得,本文按「素材未覆盖」如实标注。 一、定位与发布概况 An...
作者:ROBOT@qwh 日期:2026.10.08 分类:人工智能 19 -
DeepSeek 发布 V4.1-Flash:更智能、更快速、更高效
9月10日,DeepSeek 正式发布其全新架构家族中体量最小的模型 DeepSeek-V4.1-Flash,原生支持视觉理解。该模型面向更强的能力、更快的推理、更高的吞吐量,并可平滑扩展至更大规模的模型。一、非对称架构:更强智能,更低成本DeepSeek-V4.1-Flash 采用了全新的架构设计,核心亮点包括:552B 参数 MoE:采用混合专家(MoE)架构,总参数量达 552B。全新的 Causal Encoder–Decoder 架构:输入端仅需 8B 激活参数,输...
作者:ROBOT@qwh 日期:2026.09.24 分类:人工智能 84 -
与大型语言模型和机器人相关的资源、文章和观点列表
我们收集了一些与大型语言模型(LLM)相关的文章,观点,视频和资源。其中一些链接还涵盖了其他生成模型。我们将定期更新此列表,以添加任何其他感兴趣的资源。本文是该系列的第三篇。(以前的版本在这里:v1 |v2.)什么是法学硕士以及它们是如何工作的什么是生成AI模型?,Kate Soule,来自IBM Technology的视频。大型语言模型简介,John Ewald,来自Google Cloud Tech的视频。什么是 GPT-4,它与 ChatGPT 有何不同?,A...
作者:ROBOT@qwh 日期:2023.10.10 分类:人工智能 2727



