
LLM
0关注 | 19内容
Pydantic 校验通过不等于答案正确:如何识别 LLM 的语义错误
本地测试时,结构化输出最容易给人一种“问题已经解决”的错觉:模型返回 JSON,解析器没有报错,Pydantic 模型实例化成功,数据库也顺利写入。真正上线一段时间后,团队才发现其中有些记录虽然格式完

AI 结构化输出的隐形失败:合法 JSON 不等于正确数据
很多人接入 OpenAI 结构化输出(Structured Outputs)的体验是这样的:用 Pydantic 定义一个模型,把 response_format 指过去,模型就乖乖按字段返回,不再有

用 OpenAI Agents SDK 构建一个能写代码、还能执行代码的 AI Agent
大语言模型(LLM)已经能够生成代码,但真正让 Agent 发挥价值的,并不是"写代码",而是写完之后还能自己运行、验证,再根据结果继续迭代。拥有代码执行能力后,一个 Agent 就不仅仅是聊天机器人

来玩!主包耗时一个月制作的酒馆同人角色卡 附带安装宝宝教程

1373次播放 | 11:10初次用AI AGENT开发的动画Tier List制作工具-总结报告
最近试了试agent,惊为天人,想着用它整点啥,刚好,我觉得TierMaker的UI太丑了,我的审美疯狂拒绝我使用,所以决定自行制作,耗时一周搓了出来,请欣赏我的shi山!另外真的是0基础,一行代码也


共8张用AI搓了个「动画评价排行」工具附带AI雌小鬼动画总结-BGM-AniTier

1059次播放 | 04:02为创作同人动画 开发了个星铁剧情索引AI [俊达萌]

1043次播放 | 06:01DeepSeek-V4预览版本正式上线并同步开源
DeepSeek-V4 拥有百万字超长上下文,在 Agent 能力、世界知识和推理性能上均实现国内与开源领域的领先。模型按大小分为两个版本:最新的 DeepSeek-V4 , 1M 超长上下文记忆的全
重生之我在带专学AI第2集:新建LLM环境
这把主要是要部署三个大模型的环境,blueLM——VIVO大模型、qwen——阿里千问、chatglm3——清华智谱。1.blueLM根据2月份的博主分析,蓝心大模型,在中文处理上堪称世界第一,我直接


共11张怎么使用python访问大语言模型

395次播放 | 08:30关于我目前的状况,以及“再平衡”

342次播放 | 04:58Asteria吐槽自动机: 基于大模型的弹幕生成工具

169次播放 | 05:41C++手搓大模型推理引擎

94次播放 | 08:01International Trade Law 国际贸易法

1165次播放 | 00:40Nature新闻:未来的智能会是什么样的?答案可能蕴含在它进化历程的故事中。
人工智能的出现或许只是一个指导性生物过程中的最新阶段,这个过程在生命历史的长河中创造了越来越复杂、相互依存的有机体。十年前,我还会对机器能够思考的想法嗤之以鼻。在2010年代,我在谷歌研究团队工作,致

正在加载



