一个由 3 个 Gemini 3.7 Flash 智能体组成的团队协作,从零开始自主训练了一个机器人模型。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsrtflzo0497ro0niedsxhfx
AI HOT
Google 推出 Gemini 3.7 Flash,这是对 3.6 Flash 的算法改进而非新预训练模型,支持 1M-token 上下文窗口和最高 64K 输出 token。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsrtfopg04anro0n5b67zaf2
Gemini 3.7 Flash 现已在 Cursor 中可用! 以下是我们评估中的部分结果 ↓ 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsrtfncx049zro0nucejkubs
X 宣布开源 For You 时间线推荐算法,公开帖子排名与过滤机制,涵盖核心排序系统、模型配置、时间线过滤器及影响可见性的内容标签。同时推出"Under the Hood"页面,符合条件的用户可查看账号或帖子是否被施加可见性限制标签并下载数据。试点面向随机选取的、注册满一年且上月发帖超 10 次的账号,并邀请独立推荐系统专家审查。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsrtfj6q047rro0ni98bf4v6
ChatGPT 或 Codex 有没有真的帮你省过钱? 抓到过错误发票、发现账单差错、取消订阅、协商账单等等。 发生了什么,省了多少,工作流程是怎样的? 回复或私信我。想听真实案例! 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsrtfj33047oro0nsw5m43np
Cerebras 预览 GPT-5.6 Sol Ultrafast 模式,生成速度最高 750 tokens/秒,比标准处理快 14 倍。该模式跑完 Humanity's Last Exam 仅用 11 小时 11 分,比 Claude Fable 5 快近 7 倍且准确率相当。用户称瓶颈已从模型转向工具本身。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsrtfo9c04afro0nua5lfr0o
Google 将 Gemini 3.7 Flash 部署至 Gemini Spark,并改进其操作 Google Workspace 应用的工具使用能力。该模型被官方称为面向编程与智能体的最强"工作马"模型。Spark 现已向 160 多个国家的 Pro 和 Ultra 订阅用户开放。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsrtfrxm04c5ro0ns5p5w955
Grok 4.6 再次获胜。👑 Grok 4.6 以 94.9% 的分数在 GPQA Diamond 上夺得第一名,击败了 GPT-5.6、Gemini 3.1 Pro、Claude Opus 5 以及 Artificial Analysis 测试的所有其他模型。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsrtfj6q047sro0nm3okt4aq
Gemini 3.7 Flash 在 OpenRouter 上独家额外五折,优惠持续至 8 月 27 日。 根据我们的测试,我们认为 @GoogleDeepMind 的新模型在 OpenRouter 的价格下,将在多模态和智能体工作负载方面尤其具有竞争力。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsrsqxre03tzro0nq9ve4h1j
Aidan McLaughlin 宣布稍后将加入直播,分享其研究工作与最新研究见闻。直播还将讨论 Databricks 50 亿美元融资、Anthropic 智能体集群研究、DeepSeek V4 定价及 AI 政策等话题,并有多场嘉宾访谈。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsrstsgl03zpro0nil7c0pmu