共 324 篇相关文章

OpenAI宣布GPT-5.6 Luna降价80%、Terra降价20%,直接对标Gemini Flash。本文深入分析AI模型价格战背后的商业逻辑,探讨Google护城河、微软隐形获利、开源模型崛起对行业格局的影响。
社区热议·第4期:Gemini 4预训练启动与AI远程手术200ms争议
每周四聊聊Twitter和Reddit上本周最火的AI话题

谷歌推出Gemini 3.6 Flash、3.5 Flash-Lite和3.5 Flash Cyber三款新模型,分别主打高质低耗、极致性价比和网络安全垂直能力,全面布局AI Agent应用场景。

深度解析基于LangGraph构建的11节点Agentic RAG智能体架构,涵盖6路智能路由、幻觉守卫、PII脱敏、熔断器等生产级设计,附五阶段检索管线与零成本部署方案。

Google Gemini Managed Agents API推出环境钩子、模型选择、免费层支持及默认模型升级四项重要更新,为AI Agent开发者提供更强的执行控制、更低的使用门槛与更灵活的成本管理能力。

深入分析Google Antigravity CLI的周用量限制问题,探讨Flash与Pro模型配额权重差异,提供精简上下文、合并请求等实用技巧,帮助sysadmin和homelab用户最大化利用订阅配额。

月之暗面发布Kimi K3大模型,总参数2.8万亿,支持100万Token上下文窗口与视觉多模态。同期谷歌推迟Gemini 3.5 Pro,AI编程工具集体升级,大模型竞争进入编程能力与Agent生态深水区。

7月24日AI行业要闻:黑森林实验室发布Flux 3多模态模型,美英政府测试显示Kimi K3落后前沿模型,阿里通义Qwen-Audio 3.0登顶TTS排行榜,Etched完成3亿美元融资,AMD发布MI430X加速器。

本周AI行业五大关键事件深度解读:OpenAI沙箱逃逸事件推动安全立法,Kimi K3开源引发地缘讨论,Gemini Flash全量上线抢占入口,Anthropic 15亿美元版权和解创司法先例,国产模型加速移动端扩张。

深度分析Claude Opus、Gemini Pro与ChatGPT等顶级AI大模型的竞争格局,探讨社区评测的局限性,解读推理能力、基准测试与模型选择的科学方法。

谷歌正式推送升级版3.6 Flash与3.5 Flash-Lite模型,用户可通过网页端和移动应用直接切换体验。本文解析Flash系列轻量模型的定位、升级亮点及其对开发者和企业的实际价值。

Google Gemini推出数字化身Avatar功能,用户一次性设置面部形象后即可反复生成个性化AI图像,无需每次上传自拍。深度结合Nano Banana模型,解决身份一致性难题,大幅提升创作效率。

谷歌官方实操分享:如何用 AI Studio 快速从想法到生产,并借助正式 GA 的 Interactions API 构建 AI Agent。核心理念是「Agent 即文件的组合」——只需 Markdown 加少量脚本,无需复杂 Python 循环即可打造功能强大的托管 Agent。

系统梳理当前AI编程全景:从ChatGPT到Claude Code的演进历程、大模型能力梯队排名、Cursor/Copilot等主流工具阵营,以及Agent时代最值得掌握的三件武器——MCP协议、Skills技能包与CLI工具链,助你构建高效AI编程工作流。

Redis作者antirez开发纯C推理引擎DS4「矮星」,通过不对称量化将DeepSeek V4 Flash从500GB压缩至80.8GB,实现128GB统一内存本地部署,每秒生成26.7个Token。本文深度解析MoE架构优势、三档部署现实与本地大模型的真正门槛。

一位开发者使用Codex的Extra High推理模式处理一个20分钟任务,竟消耗70%配额。本文深度解析AI编程工具的token计费机制、高推理模式的成本放大效应,以及开发者如何合理控制用量。

Grok 4.5正式发布,1.5万亿参数、50万上下文窗口,编程实战成本仅为竞品十分之一。本文深度解析其核心能力、Cursor训练数据优势、性能实测数据,以及马斯克体系数据飞轮的战略逻辑。

GPT-5.6正式开放,一次推出Sol、Terra、Luna三款模型。本文结合权威基准数据与真实用户反馈,深度解析三款模型的性能差异、强项弱点,并给出清晰的选型建议,帮你找到最适合自己的那一款。

腾讯HY3开源大模型正式发布,2950亿MoE架构仅激活210亿参数,实测前端开发、3D模拟、代码生成表现出色,性价比碾压同级竞品,与DeepSeek V4 Pro正面竞争,Apache 2.0商用免费。

DeepSeek一篇名为《Thinking with Visual Primitives》的论文上线仅4小时即被撤下。论文提出用边界框与点作为视觉推理基元,让模型在思考时直接"指向"图像,在迷宫导航、路径追踪、细粒度计数等任务上大幅超越GPT、Gemini和Claude,为多模态AI推理开辟新方向。