共 609 篇相关文章

通义千问Qwen 3.8 Max拥有2.4万亿参数,即将开源。KingBench实测综合得分81.25%,位列排行榜第二,超越Claude Opus 4.8,仅次于Fable 5。本文详解8道测试题表现、真实使用体验与短板分析。

阿里通义千问Qwen3最强版本实测:2.4万亿参数开源大模型在KingBench综合评测中以81.25%高分排名第二,超越Claude Opus 4.8,在游戏开发、数学推理、智能体任务三项满分。预览版已可通过Token套餐免费使用。

本期AI日报聚焦五大板块:DeepSeek V4疑似开启灰度测试,思维链质量显著提升;马斯克预告Grok 4.6与5.0下周开测,参数规模达2万亿;上海AI实验室Intern-S2开源模型击败Claude Opus 4.8;xAI建成2000MW级Colossus训练集群;英伟达RoboTTT突破机器人长时程操作瓶颈。

Moonshot AI的Kimi K3发布即登顶开源模型榜单,K3.1随即预热;Grok 4.6即将完成2万亿参数训练;DeepSeek新模型灰度测试;Anthropic订阅策略反复调整。本文梳理AI领域关键动向,解析开源与闭源系统的差距为何正在快速缩小。

DeepSeek等开源模型工具调用表现差,真的是模型本身的问题吗?本文深度解析"工具修复框架"的设计思路,揭示框架层缺陷如何被误算为模型能力短板,以及如何通过确定性修复规则和修复节点机制,让开源模型稳定运行超长智能体任务。
Open Deep Research:LangChain开源AI研究智能体完…
深度解析LangChain开源项目open_deep_research:基于LangGraph构建的AI深度研究智能体,支持多模型、多搜索工具灵活配置,已获12000+ Star。覆盖技术架构、核心工作流、典型应用场景与落地建议,帮助开发者快速掌握Agentic RAG实践路径。

Kimi K3正式发布,2.8万亿总参数、896个MoE专家、百万级上下文,编程基准超越GPT与Gemini。本文深度解析其线性注意力、Attention Vigilance等核心技术,以及Perception Bench多模态评测表现,带你读懂这款全球最强开源大模型。

深度解析Claude Code智能体编程工具的完整使用方法,涵盖安装配置、定价套餐、模型选择、Token管理、CLAUDE.md全局记忆、MCP集成、Subagent等高级技巧,助你快速掌握AI编程工作流。

AI编程额度总是不够用?本文拆解一套「大脑与手脚分离」的省Token方案:让强模型只负责规划思考,用DeepSeek等低成本模型承接写代码、调试等高频执行任务,配合订阅额度优先策略,帮助Vibe Coding新手用最低成本跑通第一个项目。
社区热议·第3期:Grok 4.5越狱风波与AI删库惊魂
每周四聊聊Twitter和Reddit上本周最火的AI话题
社区热议·第3期:Grok 4.5越狱狂欢与GPT-5.6删库惊魂
每周四聊聊Twitter和Reddit上本周最火的AI话题

OpenAI发布基于GPT-Live 1.0的全新ChatGPT Voice,实现全双工语音交互,支持打断、实时搜索、深度推理与多语言实时翻译。本文深度解析其核心能力与应用场景,带你了解语音AI的全新范式。

一位用户设置2欧元消费限额,却被扣除15欧元——超出700%。本文深度剖析AI API限额失效的根本原因:计费异步延迟与上下文隐性成本,并提供实用的自我保护策略,帮助开发者避免意外天价账单。

开源项目PXPipe将系统提示词、工具文档等长上下文渲染为图片发送给Claude,利用视觉Token计费差价,实测输入Token减少68%、整体账单节省59%~70%。本文深度拆解其工程原理、分层记忆策略与使用边界。

OpenAI CEO Sam Altman在X平台连续嘲讽Anthropic及Claude,讽刺其营销"是笑话"、访问限制保守。本文深度解读这场AI巨头口水战背后的竞争战略,以及用户体验如何成为大模型新战场。
每日AI新鲜事·07月15日早间版:Opus 5传闻与Fable 5真实体验
2026年07月15日早间版 AI新闻速递+热点深度讨论

DeepSeek V4本月即将发布,Flash版或超越同级最强开源模型HY3,并首次支持原生视觉;OpenAI承认悄悄下调GPT-5.6推理预算;Anthropic延长Fable 5访问权限应对GPT-6竞争;字节Seedance 2.5支持180秒4K视频生成——AI竞争持续白热化。

AI圈24小时重磅动态:DeepSeek V4 Flash正式版即将推出,原生支持视觉能力;OpenAI承认GPT-5.6-Soul推理预算被下调;Anthropic重开Fable 5留住用户;字节跳动C-Dance 2.5支持3分钟4K视频生成。一文梳理最新AI行业动向。
AI Agent Skill 设计深度解读:Anthropic 与 Perp…
深度解读 Anthropic Claude Code 团队与 Perplexity Agent 团队的 Skill 设计哲学,涵盖税收测试、Gotchas 飞轮、渐进式披露、Eval-First 流程等核心原则,帮助工程师构建高质量 AI Agent 技能系统。

OpenAI最新更新:Codex客户端并入ChatGPT,新增工作模式;GPT-5.6拆分为Sol(旗舰)、Terra(均衡)、Luna(轻量)三档。本文详解三版本能力差异、成本对比及选型建议。