Opus 5.5 发布一周:社区称其擅长生成解说视频
Anthropic 的 Opus 5.5 本周发布后,社区反馈集中在用代码生成解说视频上,SimpleBench 得分 88.4%,在 Terminal-Bench-Science 上从低推理档的 24% 升至 xhigh 档的 62%。
Anthropic 的 Opus 5.5 本周发布后,社区反馈集中在用代码生成解说视频上,SimpleBench 得分 88.4%,在 Terminal-Bench-Science 上从低推理档的 24% 升至 xhigh 档的 62%。
xAI 的 Grok 4.7 已在 Amazon Bedrock 上线,支持 500K token 上下文窗口和 low、medium、high、xhigh 四档可配置推理强度,通过 bedrock-runtime 的跨区域推理配置文件提供服务,支持 Responses、Chat Completions 和 Converse API。
推荐理由:文章给出 Grok 4.7 在 Bedrock 上的接入方式与四档推理强度配置,可据此评估长任务智能体的成本与延迟取舍。
Anthropic 发布 Claude Opus 5.5,约一小时后 OpenAI 发布 GPT-6 Sol 和 GPT-6 Luna。
推荐理由:作者实测了同日发布的四款新模型,并给出完整价格对比表,可据此判断这轮降价对应用成本的影响。