共 50 篇相关文章

深度解析Project Rai-chan的技术栈实现,涵盖Ollama+Gemma本地大模型、Unity渲染、VOICEVOX语音合成等核心组件,探讨本地AI伴侣在记忆系统、隐私保护与多模态整合方面的技术路径。

月之暗面发布Kimi K3大模型,总参数2.8万亿,支持100万Token上下文窗口与视觉多模态。同期谷歌推迟Gemini 3.5 Pro,AI编程工具集体升级,大模型竞争进入编程能力与Agent生态深水区。

谷歌官方实操分享:如何用 AI Studio 快速从想法到生产,并借助正式 GA 的 Interactions API 构建 AI Agent。核心理念是「Agent 即文件的组合」——只需 Markdown 加少量脚本,无需复杂 Python 循环即可打造功能强大的托管 Agent。

DeepSeek开源推测解码工具库DeepSpec,生产环境实测推理速度提升60-85%,吞吐量最高提升661%。集成三大算法、九个预训练Checkpoint与九个评测基准,三步即可上手,MIT协议免费商用。

阿里通义千问Qwen 3 Max深度评测:2.4万亿参数、即将开放权重,八项测试综合得分81.25%高居榜单第二,超越Claude Opus、Kimi K3和GPT-4系列,国产大模型迎来重要突破。

Anthropic Claude Code Artifacts正式面向Pro/Max用户开放,支持生成交互式网页并实时部署。本文盘点AI Agent最新动态:阿宝公测、字节EdgeBench评测、微软Frontier Company成立,及OpenAI、Anthropic的算力布局。

通义千问Qwen 3.8 Max拥有2.4万亿参数,即将开源。KingBench实测综合得分81.25%,位列排行榜第二,超越Claude Opus 4.8,仅次于Fable 5。本文详解8道测试题表现、真实使用体验与短板分析。

阿里通义千问Qwen3最强版本实测:2.4万亿参数开源大模型在KingBench综合评测中以81.25%高分排名第二,超越Claude Opus 4.8,在游戏开发、数学推理、智能体任务三项满分。预览版已可通过Token套餐免费使用。

开发者仅凭GDScript与Vulkan计算着色器,无需llama.cpp或外部依赖,在Godot 4引擎内完整运行Gemma大语言模型。本文深入解析其技术架构、性能表现与实际价值,探讨游戏引擎原生运行LLM的可行性。

一周内OpenAI、xAI、谷歌、微软四大AI厂商同时降价,近前沿推理成本大幅下探;微软Copilot在4.5亿席位中付费转化率不足4.5%,揭示通用AI助手的变现困境。本文梳理GPT-5.6、Grok 4.5、Gemini延期、DeepSeek API退役等关键事件及开发者应对策略。

Gemini 3.5 Pro再度跳票,社区反应出人意料地平静。本文深度解析谷歌面临的算力成本压力、全新架构重构风险,以及在AI竞争格局中DeepMind的长期主义战略,带你读懂这次延期背后的真实信号。

WisprGemma 是开源的浏览器端本地语音输入工具,基于 WebGPU 与 Transformers.js,单模型完成语音识别与文本润色,声音永不离开设备。本文详解其架构设计、Chrome 扩展踩坑经历,以及对端侧 AI 应用的启示。

DeepSeek投机解码算法(DSpark)已正式合并至vLLM主干代码,原生支持Qwen3、Gemma等主流开源模型。测试显示单用户Token生成速率提升接近150倍,整体吞吐量提升约40%-50%,是开源大模型推理加速的重要里程碑。

DeepSeek联合北京大学发布DS Spark论文,通过置信度调度与半自回归投机解码,在不改变模型和GPU的前提下,将AI推理速度提升最高85%。深度解析这场"赌场式"推理革命的三大核心技术。

Muse Spark 1.1正式发布,主打极低使用成本,直击AI工具高昂订阅费痛点。本文深度解析其低成本定位策略、可能的技术实现路径,以及对个人开发者和中小团队的实际价值,帮你理性评估这款新晋AI产品。

OpenAI发布GPT-5.6预览版,旗舰Soul、均衡Tara、轻量Luna三款模型同步亮相。本文基于KingBench 3真实测评,详解各模型在数学、前端、智能体任务上的表现,并与Anthropic Fable进行横向对比,助你快速选型。

Unsloth v0.1.45-beta正式发布,带来Gemma 4多token预测(MTP)完整支持、AMD ROCm与NVIDIA Blackwell硬件适配、全新Hub下载管理器与紧凑型RAG系统,助力本地大模型微调与推理提速。

谷歌本周密集发布多项AI更新:Gemini 3.5 Live Translate实现实时语音翻译,NotebookLM引入智能体能力,DiffusionGemma探索文本扩散生成技术,Project Genie向高级用户开放。一文梳理谷歌最新AI布局与战略意义。

DeepSeek联合北京大学推出开源框架DiSpark,通过投机解码、半自回归生成与分级验证技术,在不更换硬件、不重训模型的前提下,让大语言模型推理速度提升60%至85%,同时保持输出质量。

AIVenture是Google团队推出的开源复古地牢游戏,将Vibe Coding、智能体工作流、工具调用等AI工程概念融入可玩关卡。基于Angular、Phaser.js与Gemma模型构建,支持本地与云端灵活部署,是开发者学习生成式AI应用开发的实践利器。