长勺智库长勺智库
话题文章任务
登录
LLatent SpaceLatent Space发布于 21 小时前
OpenRouter 的多模型押注:从“套壳”到 AI 基础设施

OpenRouter 早早押注多模型生态,发展为面向千万开发者的中立推理路由层,并在加入 Stripe 后面临代币经济与智能体欺诈新挑战。

140
AIAgent工程实践
140
AIAgent工程实践
LLatent SpaceLatent Space发布于 1 天前
Runway WorldPrompt:实时生成世界的控制层

Runway 的 GWM Worlds 2 尝试把视频与音频生成推进到实时交互模拟,WorldPrompt 则用于固定场景上下文并按时间触发动作。

210
AIAgent工程实践
210
AIAgent工程实践
LLatent SpaceLatent Space发布于 1 天前
AINews v3:社区、内容网络与近期前沿模型动态

Latent Space 计划升级 AINews、迁移新主页并重启商业合作;同时梳理 Claude、GPT、Gemini 等前沿模型近期表现。

210
AIAgent工程实践
210
AIAgent工程实践
CCloudflare AI BlCloudflare AI Bl发布于 1 天前
Cloudflare 推出 Turnstile Spin:用 AI 代理补全网站验证配置

Turnstile Spin 可借助 AI 编码代理完成前端组件嵌入与后端 Siteverify 校验,帮助修复只装前端、缺少后端验证的错误配置。

210
AI工程实践云计算开发者
210
AI工程实践云计算开发者
LLatent SpaceLatent Space发布于 2 天前
Meta Connect 2026:Muse 成为硬件与智能体战略核心

Meta 在 Connect 2026 上集中展示 Muse 个人智能体、AI 眼镜、实时语音视频、邮件与桌面操作能力,并发布 Charm 随身设备。

260
AIAgent工程实践
260
AIAgent工程实践
LLatent SpaceLatent Space发布于 2 天前
AI 科学中的“工厂”与“导航员”

AI 让科研中的思考与编码显著变便宜,但实验仍昂贵而缓慢。生物科技公司正沿两条路径适应这一不对称变化。

260
AIAgent工程实践
260
AIAgent工程实践
SSimon WillisonSimon Willison发布于 3 天前
llm 0.36 发布:新增 OpenAI 模型与单轮提示支持声明

llm 0.36 更新加入两个 OpenAI 模型标识,并允许模型插件声明不支持多轮对话,同时优化日志中推理轨迹的 Markdown 展示。

270
LLMAgent工具链
270
LLMAgent工具链
SSimon WillisonSimon Willison发布于 3 天前
Claude Opus 5.5 与 GPT-6 新模型引发价格战

Anthropic 发布 Claude Opus 5.5,OpenAI 随后推出 GPT-6 Sol 与 Luna。新一轮模型竞争的焦点,正从能力延伸到价格与缓存成本。

270
LLMAgent工具链
270
LLMAgent工具链
SSimon WillisonSimon Willison发布于 3 天前
Gemini 3.8 TTS Playground:可编排多角色对话的语音生成工具

Google 推出 Gemini 3.8 TTS 两个新模型,支持 2000 多种声音、30 秒样本定制声线,并可生成多角色对话音频。

280
LLMAgent工具链
280
LLMAgent工具链
LLatent SpaceLatent Space发布于 3 天前
John Platt谈AI如何加速科学发现

John Platt分享了Google ERA系统、AI在气候问题中的应用,以及未来科学家在超级智能时代仍需具备的领域判断力。

270
AIAgent工程实践
270
AIAgent工程实践
LLatent SpaceLatent Space发布于 3 天前
Claude Opus 5.5 发布:能力、价格与写作表现成焦点

Anthropic 发布 Claude Opus 5.5,称其多数任务接近 Claude Fable 5.1,运行成本较 Opus 5 降低 40%。OpenAI 同日推出更低价 GPT-6 Sol 与 Luna。

280
AIAgent工程实践
280
AIAgent工程实践
LLatent SpaceLatent Space发布于 3 天前
AI 正把生物安全推向攻防竞赛

生物语言模型能生成基因组,也可能帮助防御方追上风险。关键在长上下文、多模态感知与可验证的生物推理。

290
AIAgent工程实践
290
AIAgent工程实践
NNVIDIA GenerativNVIDIA Generativ发布于 3 天前
SWE-Serve:暴露本地测试与真实推理服务之间的差距

SWE-Serve 用 53 个任务评估 AI 编码补丁在真实推理服务路径中的表现,关注补丁通过本地测试却在上线服务中失败的问题。

290
AI生成式AI推理算力
290
AI生成式AI推理算力
NNVIDIA GenerativNVIDIA Generativ发布于 3 天前
AI 负载上线前,先验证 GPU 集群是否真正就绪

GPU 集群通过健康检查并不等于能稳定运行大规模 AI 训练。慢 GPU、链路负载退化或路由配置问题,都可能在任务运行数小时后才暴露。

310
AI生成式AI推理算力
310
AI生成式AI推理算力
SSimon WillisonSimon Willison发布于 4 天前
Cloudflare Python Workers 正式可用

Cloudflare 的 Python Workers 结束两年预览期,现已稳定支持在 Workers 平台运行 Python,但仍受 WebAssembly 环境限制。

290
LLMAgent工具链
290
LLMAgent工具链
SSimon WillisonSimon Willison发布于 4 天前
Jev:一种只输出决策分数的新型模型

TypeSafe AI 推出 Jev:输入文本或半结构化数据,输出分类、判断、评分及置信度。它便宜快速,但黑箱与偏见风险更突出。

290
LLMAgent工具链
290
LLMAgent工具链
SSimon WillisonSimon Willison发布于 4 天前
llm-typesafe 0.1a0:为 LLM CLI 增加 Jev 模型支持

llm-typesafe 0.1a0 发布,可让 LLM 命令行工具调用 TypeSafe AI 的 Jev 模型,支持是/否、选择和评分类问题。

290
LLMAgent工具链
290
LLMAgent工具链
LLatent SpaceLatent Space发布于 4 天前
Jev:面向生产环境的 System One 模型

TypeSafe AI CEO Diogo Almeida 解释 Jev 的设计动机:不再把聊天式大模型当作万能核心,而是面向可靠、可组合的软件自动化。

330
AIAgent工程实践
330
AIAgent工程实践
LLatent SpaceLatent Space发布于 4 天前
小米 MiMo-V2.6-Pro:开放权重模型的新前沿

小米发布 MiMo-V2.6 系列,主打原生全模态、开放权重与高性价比推理。MiMo-V2.6-Pro 在第三方智能指数中登顶开放权重模型。

290
AIAgent工程实践
290
AIAgent工程实践
IInterconnects AIInterconnects AI发布于 4 天前
关于递归自我改进、中美 AI 差距与能力跃迁的讨论

一期围绕 AI 递归自我改进、机器人作用、中美模型差距、开闭源安全与前沿后训练配方的访谈整理。

330
AI开源模型模型生态深度文章
330
AI开源模型模型生态深度文章
每日签到未签到

每天签到一次,持续获得积分。

@2024-2027长勺智库浙ICP备2024134526号浙公网安备33011002017958
?
未登录用户

登录后查看个人信息与任务进度。

去登录